وظائف بلس — أخصائي تقييم هندسة البرمجيات
وظيفة منشورة على وظائف بلس، مع تفاصيل المتطلبات والمزايا ورابط التقديم المباشر.
أخصائي تقييم هندسة البرمجيات
تتقدّم باسم
زيارة موقع الشركةالإعلان الأصلي للوظيفة
Software Engineering Evaluation Specialist Mindrift
مقارنة الرواتب
تقديري ~1,500 دينار كويتي
تقدير مبني على بيانات إقليمية، وليس عرضًا رسميًا من جهة العمل.
الوصف
يرجى تقديم سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إتقانك للغة الإنجليزية. تربط Mindrift المتخصصين بفرص الذكاء الاصطناعي القائمة على المشاريع لشركات التكنولوجيا الرائدة، مع التركيز على اختبار أنظمة الذكاء الاصطناعي وتقييمها وتحسينها. المشاركة قائمة على المشروع، وليست توظيفًا دائمًا. عن الدور ستقوم بتصميم مهام برمجة تتحدى وكلاء برمجة الذكاء الاصطناعي الرائدين. كل مهمة عبارة عن بيئة Docker قائمة بذاتها تحتوي على جزء من برنامج معطل؛ يحاول وكيل الذكاء الاصطناعي إصلاحه؛ وتتحقق الاختبارات الآلية من النتيجة. ناتجك هو حزمة المهام الكاملة: الكود المعطل، والاختبارات، والتعليمات، وحل مرجعي يثبت أن المهمة قابلة للحل. المسؤوليات: - ابتكار سيناريو مطور واقعي – خطأ حقيقي، أو ETL معطل، أو ميزة مفقودة – وليس مشكلة بسيطة. - بناء بيئة Docker قابلة للتكرار مع تبعيات مثبتة. - كتابة pytest يتحقق من النتائج، وليس الأوامر المحددة – حتمي، وغير متقلب، ولا يسرب الإصلاح. - كتابة instruction.md يشبه تذكرة Jira التي سيتلقاها المطور. - كتابة reference solve.sh يثبت أن المهمة قابلة للحل. - معايرة الصعوبة بحيث يحل وكلاء الذكاء الاصطناعي الحاليون المتطورون المهمة بنسبة 20-60% من الوقت. - التكرار بناءً على ملاحظات مراجعي ضمان الجودة الخبراء. - لاحقًا: مراجعة مهام المؤلفين الآخرين كمراجع ضمان جودة. ليس في النطاق - تسمية البيانات، هندسة المطالبات. - كود الإنتاج للشحن – أنت تصمم المشكلات والتحقق لوكلاء الذكاء الاصطناعي. - ألغاز Leetcode – يجب أن تبدو السيناريوهات وكأنها عمل مطور حقيقي. - ليست كل مهمة مرشحة يتم شحنها – الجودة قبل الكمية. المتطلبات - 3+ سنوات من تطوير برامج الإنتاج في حزمة خلفية واحدة – Python، Go، Node.js، Java، أو Rust. العمق في حزمة واحدة أفضل من الاتساع. - إتقان Python + pytest – مطلوب بغض النظر عن الحزمة الأساسية. حزمة المهام تستند إلى pytest حتى عندما يكون التطبيق المعطل بلغة أخرى. Fixtures، parametrize، monkeypatch، timeouts، conftest.py. - تأليف Docker – Dockerfiles قابلة للتكرار، تبعيات مثبتة، بناء متعدد المراحل عند الحاجة، مستخدم غير جذري. - Linux & Bash – راحة التصحيح داخل الحاويات (strace، lsof، journalctl)؛ shell يتجاوز set -euo pipefail. - خبرة وكيل برمجة الذكاء الاصطناعي – Claude Code، Cursor، Roo Code، أو ما شابه ذلك، في عمل غير تافه. يمكنك الاستشهاد بوقت محدد كان فيه الذكاء الاصطناعي مخطئًا بثقة وكيف اكتشفت ذلك. - الإنجليزية – B2+ كتابةً. غير مناسب - مهندسو علوم البيانات، تعلم الآلة، أو الرؤية الحاسوبية بدون مخرجات هندسة خلفية. - مختبرو ضمان الجودة اليدويون بدون أتمتة أو تأليف اختبارات. - الواجهة الأمامية فقط، أو الكود المنخفض / بدون كود، أو دعم تكنولوجيا المعلومات، أو محللو الأعمال. - المهندسون الذين لم يكتبوا pytest من البداية مطلقًا. - مبتدئ، متدرب، أو مساعد كأحدث دور. المؤهلات المفضلة - عمق المجال في الأمن، إدارة الأنظمة (nginx / systemd / cron)، الحوسبة العلمية (NumPy / PyTorch / SciPy)، DevOps، أو أساسيات Git. - أدوات Python الحديثة (uv، poetry، pyproject.toml). - أدوات التغطية (pytest-cov، coverage.py، gcov، llvm-cov، kcov). - اختبار التعتيم أو الاختبار القائم على الخصائص (Hypothesis). - المساهمة السابقة في معايير تقييم الوكلاء أو الأطر ذات الصلة. العملية التقديم ← اجتياز التأهيل (اختبار مهمة عينة لمدة 90 دقيقة + مقابلة سلوكية قصيرة) ← الانضمام إلى مشروع ← إكمال المهام ← الحصول على الأجر. الالتزام بالوقت - الإعداد: ~10 ساعات لكل مهمة أولى. - الحالة المستقرة: ~5 ساعات لكل مهمة، 2-4 مهام متوازية لكل مؤلف. - عبء العمل الأسبوعي الواقعي: 8-20 ساعة. حجم أعلى متاح لأصحاب الأداء الأفضل. - أنت تختار متى وكيف تساهم؛ يجب تقديم المهام بحلول الموعد النهائي وتلبية معايير القبول. التعويض: - مساهمات مدفوعة، تصل الأسعار إلى 35 دولارًا/ساعة*. - تعويض قائم على المهام يعادل السعر بالساعة، اعتمادًا على الأداء والحجم. - تتضمن بعض المشاريع مدفوعات حوافز. *تختلف الأسعار بناءً على الخبرة، وتقييم المهارات، والموقع، واحتياجات المشروع، وعوامل أخرى. قد يتم توفير أسعار أعلى للخبراء المتخصصين للغاية. قد تنطبق أسعار أقل أثناء الإعداد أو مراحل المشروع غير الأساسية. يتم مشاركة تفاصيل الدفع لكل مشروع. التقديم قدم سيرتك الذاتية عبر منصة Mindrift. أشر إلى مستوى إتقانك للغة الإنجليزية، واذكر هذا الدور (أخصائي تقييم هندسة البرمجيات – Terminal Bench)، وقم بتضمين رابط ملف GitHub الشخصي إن وجد.
ما ستقوم به
- • تصميم مهام برمجة واقعية وبيئات Docker قابلة للتكرار لتقييم وتحسين وكلاء برمجة الذكاء الاصطناعي الرائدين. إنشاء مجموعات اختبار شاملة وحلول مرجعية للتحقق من أداء الذكاء الاصطناعي مقابل سيناريوهات المطورين الواقعية.
المتطلبات
يتطلب 3+ سنوات من الخبرة في تطوير برامج الإنتاج في حزمة خلفية مع إتقان Python و pytest. يجب أن يمتلك المرشحون مهارات قوية في Docker و Linux و Bash، بالإضافة إلى الخبرة في استخدام وكلاء برمجة الذكاء الاصطناعي.
نسبة التوافق13%
نصائح المقابلة
استعد لمناقشة خبرتك في تطوير البرمجيات الخلفية، خاصةً مع Python و pytest، وكيف قمت بتطبيقها في مشاريع سابقة.
كن مستعدًا لمناقشة تجربتك مع Docker و Linux و Bash، وكيف تستخدم هذه الأدوات لتصحيح الأخطاء وإنشاء بيئات قابلة للتكرار.
سلط الضوء على أي خبرة لديك مع وكلاء برمجة الذكاء الاصطناعي وكيف قمت بتقييم أدائهم أو تحديد الأخطاء في عملهم.
استعرض قدرتك على تصميم مهام برمجة واقعية ومعقدة، مع التركيز على كيفية التأكد من أن المهام قابلة للحل وقابلة للتقييم.
اقتراح آلي للمسار الوظيفي، وليس توصية رسمية من صاحب العمل.
المسار الوظيفي
مهندس برمجيات أول
أخصائي تقييم هندسة البرمجيات
مهندس اختبار أتمتة
مهندس تعلم آلة
الأسئلة الشائعة
ما هو الدور الرئيسي لأخصائي تقييم هندسة البرمجيات؟
الدور الرئيسي هو تصميم مهام برمجة تتحدى وكلاء برمجة الذكاء الاصطناعي الرائدين، وإنشاء بيئات Docker قابلة للتكرار، وكتابة اختبارات آلية، وتقديم حلول مرجعية للتحقق من أداء الذكاء الاصطناعي.
ما هي المتطلبات الأساسية لهذا الدور؟
يتطلب الدور 3+ سنوات من تطوير برامج الإنتاج في حزمة خلفية واحدة (Python، Go، Node.js، Java، أو Rust)، وإتقان Python + pytest، وتأليف Docker، وخبرة في Linux & Bash، وخبرة في وكلاء برمجة الذكاء الاصطناعي، ومستوى B2+ في اللغة الإنجليزية كتابةً.
هل هذا توظيف دائم؟
لا، المشاركة قائمة على المشروع، وليست توظيفًا دائمًا.
ما هو الالتزام الزمني المتوقع؟
يتضمن الإعداد حوالي 10 ساعات لكل مهمة أولى، وحوالي 5 ساعات لكل مهمة في الحالة المستقرة، مع عبء عمل أسبوعي واقعي يتراوح بين 8-20 ساعة. يمكن للمرشحين اختيار متى وكيف يساهمون.
كيف يتم التقديم لهذا الدور؟
يجب تقديم السيرة الذاتية عبر منصة Mindrift، مع الإشارة إلى مستوى إتقان اللغة الإنجليزية، وذكر الدور (أخصائي تقييم هندسة البرمجيات – Terminal Bench)، وتضمين رابط ملف GitHub الشخصي إن وجد.
العمل في مدينة الكويت
تُعد مدينة الكويت مركزًا اقتصاديًا حيويًا في منطقة الخليج، وتتميز بسوق عمل ديناميكي يجذب المواهب من مختلف أنحاء العالم. تهيمن على اقتصاد المدينة قطاعات النفط والغاز، التمويل، الخدمات المصرفية، والإنشاءات، بالإضافة إلى نمو ملحوظ في قطاعات التكنولوجيا والضيافة. تتميز بيئة العمل في الكويت بكونها متعددة الثقافات، حيث يعمل الكويتيون جنبًا إلى جنب مع المغتربين، مما يخلق تبادلًا للخبرات ووجهات النظر. غالبًا ما تُقدر العلاقات الشخصية والشبكات المهنية في بيئة العمل الكويتية. تتسم ثقافة العمل بالاحترام والالتزام بالتقاليد، مع تزايد الانفتاح على الابتكار والتطور. يمكن للمحترفين الطموحين أن يجدوا فرصًا واعدة للنمو الوظيفي في هذه المدينة المزدهرة، حيث تسعى الشركات الكبرى والصغرى على حد سواء إلى استقطاب الكفاءات لتعزيز مكانتها في السوق الإقليمي.
موقع تجميع وظائف من جهات خارجية. الحقول المنظَّمة (المهام، المتطلبات، المزايا، التعليم، الراتب، الأسئلة) مُستنبَطة آلياً من الإعلان الأصلي وقد تكون غير دقيقة. يُرجى التحقّق عبر الموقع الرسمي لصاحب العمل قبل التقديم.