تخطى إلى المحتوى
ربما تم شغل هذه الوظيفة

وظائف بلس — أخصائي تقييم هندسة البرمجيات

وظيفة منشورة على وظائف بلس، مع تفاصيل المتطلبات والمزايا ورابط التقديم المباشر.

🔔 تنبيهات على Telegram
مايندريفت

مايندريفت

Technology, Information and Internet
الرياض

أخصائي تقييم هندسة البرمجيات

دوام جزئي 2-5
زيارة موقع الشركة

الإعلان الأصلي للوظيفة

Software Engineering Evaluation Specialist Mindrift

مقارنة الرواتب

5k – 8k ريال سعودي
مبتدئ هذه الوظيفة تنفيذي

ثقة متوسطة · 5,000 ريال سعودي/شهرياً – 8,000 ريال سعودي/شهرياً

الرواتب المعروضة تقديرية ومبنية على بيانات السوق المتاحة، وقد لا تعكس الراتب الفعلي للوظيفة.

الوصف

يرجى تقديم سيرتك الذاتية باللغة الإنجليزية وتوضيح مستوى إتقانك للغة الإنجليزية. تربط Mindrift المتخصصين بفرص الذكاء الاصطناعي القائمة على المشاريع لشركات التكنولوجيا الرائدة، مع التركيز على اختبار أنظمة الذكاء الاصطناعي وتقييمها وتحسينها. المشاركة قائمة على المشاريع، وليست توظيفًا دائمًا. عن الدور ستقوم بتصميم مهام برمجة تتحدى وكلاء برمجة الذكاء الاصطناعي الرائدين. كل مهمة عبارة عن بيئة Docker مستقلة تحتوي على جزء من برنامج معطل؛ يحاول وكيل الذكاء الاصطناعي إصلاحه؛ وتتحقق الاختبارات الآلية من النتيجة. ناتجك هو حزمة المهام الكاملة: الكود المعطل، والاختبارات، والتعليمات، وحل مرجعي يثبت أن المهمة قابلة للحل. المسؤوليات: - ابتكار سيناريو مطور واقعي — خطأ حقيقي، ETL معطل، ميزة مفقودة — وليس مشكلة بسيطة. - بناء بيئة Docker قابلة لإعادة الإنتاج مع تبعيات مثبتة. - كتابة pytest يتحقق من النتائج، وليس الأوامر المحددة — حتمي، غير متقلب، ولا يسرب الإصلاح. - كتابة instruction.md تبدو وكأنها تذكرة Jira سيتلقاها المطور. - كتابة solve.sh مرجعي يثبت أن المهمة قابلة للحل. - معايرة الصعوبة بحيث يحل وكلاء الذكاء الاصطناعي المتطورون المهمة بنسبة 20-60% من الوقت. - التكرار بناءً على ملاحظات مراجعي ضمان الجودة الخبراء. - لاحقًا: مراجعة مهام المؤلفين الآخرين كمراجع ضمان جودة. ليس ضمن النطاق - تسمية البيانات، هندسة المطالبات. - كود إنتاجي للشحن — أنت تصمم المشكلات والتحقق لوكلاء الذكاء الاصطناعي. - ألغاز Leetcode — يجب أن تبدو السيناريوهات وكأنها عمل مطور حقيقي. - ليست كل مهام المرشحين يتم شحنها — الجودة أهم من الكمية. المتطلبات - 3+ سنوات من تطوير برامج الإنتاج في حزمة خلفية واحدة — Python، Go، Node.js، Java، أو Rust. العمق في حزمة واحدة أفضل من الاتساع. - إتقان Python + pytest — مطلوب بغض النظر عن الحزمة الأساسية. حزمة المهام تعتمد على pytest حتى عندما يكون التطبيق المعطل بلغة أخرى. Fixtures، parametrize، monkeypatch، timeouts، conftest.py. - تأليف Docker — Dockerfiles قابلة لإعادة الإنتاج، تبعيات مثبتة، بناء متعدد المراحل عند الحاجة، مستخدم غير جذري. - Linux & Bash — راحة في تصحيح الأخطاء داخل الحاويات (strace، lsof، journalctl)؛ shell يتجاوز set -euo pipefail. - خبرة وكيل برمجة الذكاء الاصطناعي — Claude Code، Cursor، Roo Code، أو ما شابه ذلك، في عمل غير تافه. يمكنك الاستشهاد بوقت محدد كان فيه الذكاء الاصطناعي مخطئًا بثقة وكيف اكتشفت ذلك. - الإنجليزية — B2+ كتابةً. غير مناسب - مهندسو علوم البيانات، تعلم الآلة، أو الرؤية الحاسوبية بدون ناتج هندسة خلفية. - مختبرو ضمان الجودة اليدويون بدون أتمتة أو تأليف اختبارات. - مهندسو الواجهة الأمامية فقط، low-code / no-code، دعم تكنولوجيا المعلومات، أو محللو الأعمال. - المهندسون الذين لم يكتبوا pytest من الصفر أبدًا. - مبتدئ، متدرب، أو مساعد كأحدث دور. المؤهلات المفضلة - عمق المجال في الأمن، إدارة الأنظمة (nginx / systemd / cron)، الحوسبة العلمية (NumPy / PyTorch / SciPy)، DevOps، أو Git internals. - أدوات Python الحديثة (uv، poetry، pyproject.toml). - أدوات التغطية (pytest-cov، coverage.py، gcov، llvm-cov، kcov). - اختبار التشويه أو الاختبار القائم على الخصائص (Hypothesis). - مساهمة سابقة في معايير تقييم الوكلاء أو الأطر ذات الصلة. العملية التقديم ← اجتياز التأهيل (فحص مهمة عينة لمدة 90 دقيقة + مقابلة سلوكية قصيرة) ← الانضمام إلى مشروع ← إكمال المهام ← الحصول على الأجر. الالتزام بالوقت - الإعداد: ~10 ساعات للمهمة الأولى. - الحالة المستقرة: ~5 ساعات لكل مهمة، 2-4 مهام متوازية لكل مؤلف. - عبء العمل الأسبوعي الواقعي: 8-20 ساعة. حجم أكبر متاح لأصحاب الأداء الأفضل. - أنت تختار متى وكيف تساهم؛ يجب تقديم المهام بحلول الموعد النهائي وتلبية معايير القبول. التعويض: - مساهمات مدفوعة، أسعار تصل إلى 35 دولارًا في الساعة*. - تعويض قائم على المهام يعادل السعر بالساعة، اعتمادًا على الأداء والحجم. - تتضمن بعض المشاريع مدفوعات حوافز. - *تختلف الأسعار بناءً على الخبرة، وتقييم المهارات، والموقع، واحتياجات المشروع، وعوامل أخرى. قد يتم توفير أسعار أعلى للخبراء المتخصصين للغاية. قد تنطبق أسعار أقل أثناء الإعداد أو مراحل المشروع غير الأساسية. يتم مشاركة تفاصيل الدفع لكل مشروع. التقديم قدم سيرتك الذاتية عبر منصة Mindrift. أشر إلى مستوى إتقانك للغة الإنجليزية، واذكر هذا الدور (أخصائي تقييم هندسة البرمجيات — Terminal Bench)، وقم بتضمين رابط ملف GitHub الشخصي إذا كان متاحًا.

ما ستقوم به

  • • تصميم مهام برمجة واقعية وبيئات Docker قابلة لإعادة الإنتاج لتقييم وتحسين وكلاء برمجة الذكاء الاصطناعي الرائدين. التحقق من نتائج المهام باستخدام مجموعات pytest الآلية والتكرار بناءً على ملاحظات ضمان الجودة من الخبراء.

المتطلبات

يتطلب 3+ سنوات من الخبرة في تطوير برامج الإنتاج في حزمة خلفية وإتقان Python وpytest. يجب على المرشحين إظهار الكفاءة في Docker وLinux والخبرة في العمل مع وكلاء برمجة الذكاء الاصطناعي.

نسبة التوافق13%

نصائح المقابلة

استعد لمناقشة خبرتك في تطوير البرمجيات الخلفية، مع التركيز على Python وpytest. كن مستعدًا لعرض أمثلة محددة لمشاريعك.

سلط الضوء على تجربتك مع Docker وLinux، خاصة فيما يتعلق بتصحيح الأخطاء داخل الحاويات وتأليف Dockerfiles قابلة لإعادة الإنتاج.

كن مستعدًا لمناقشة تجربتك مع وكلاء برمجة الذكاء الاصطناعي، وكيف قمت بتقييم أدائهم أو تحديد الأخطاء في مخرجاتهم.

أظهر قدرتك على التفكير الإبداعي في تصميم مهام برمجة واقعية وصعبة لوكلاء الذكاء الاصطناعي، مع التركيز على الجودة بدلاً من الكمية.

اقتراح آلي للمسار الوظيفي، وليس توصية رسمية من صاحب العمل.

المسار الوظيفي

نقطة الدخول

مهندس اختبار الذكاء الاصطناعي

الدور الحالي

أخصائي تقييم هندسة البرمجيات

الخطوة التالية

مهندس موثوقية الموقع (SRE)

الخطوة التالية

مهندس برمجيات أول

الأسئلة الشائعة

ما هو الدور الرئيسي لأخصائي تقييم هندسة البرمجيات؟

الدور الرئيسي هو تصميم مهام برمجة تتحدى وكلاء برمجة الذكاء الاصطناعي الرائدين، وبناء بيئات Docker قابلة لإعادة الإنتاج، وكتابة اختبارات آلية للتحقق من النتائج، وتوفير حلول مرجعية.

ما هي المهارات التقنية الأساسية المطلوبة لهذا الدور؟

المهارات الأساسية المطلوبة تشمل 3+ سنوات من تطوير برامج الإنتاج في حزمة خلفية (Python، Go، Node.js، Java، أو Rust)، وإتقان Python وpytest، وخبرة في تأليف Docker، ومعرفة بـ Linux وBash، وخبرة في وكلاء برمجة الذكاء الاصطناعي.

ما هو الالتزام الزمني المتوقع لهذا الدور؟

يبلغ الالتزام الزمني المتوقع حوالي 10 ساعات للمهمة الأولى (الإعداد)، ثم حوالي 5 ساعات لكل مهمة في الحالة المستقرة، مع عبء عمل أسبوعي واقعي يتراوح بين 8-20 ساعة. يمكنك اختيار متى وكيف تساهم.

كيف يتم التعويض عن هذا الدور؟

التعويض قائم على المساهمات، بأسعار تصل إلى 35 دولارًا في الساعة. يعتمد التعويض القائم على المهام على الأداء والحجم. قد تختلف الأسعار بناءً على الخبرة والموقع واحتياجات المشروع.

كيف يمكنني التقديم لهذا الدور؟

يمكنك تقديم سيرتك الذاتية عبر منصة Mindrift. يرجى الإشارة إلى مستوى إتقانك للغة الإنجليزية، وذكر هذا الدور (أخصائي تقييم هندسة البرمجيات — Terminal Bench)، وتضمين رابط ملف GitHub الشخصي إذا كان متاحًا.

العمل في الرياض

تُعد الرياض، عاصمة المملكة العربية السعودية، مركزًا اقتصاديًا حيويًا يجذب المهنيين من مختلف أنحاء العالم. تتميز المدينة بسوق عمل ديناميكي يدعمه قطاعات رئيسية مثل النفط والغاز، التمويل، التكنولوجيا، والإنشاءات، مما يوفر فرصًا وظيفية متنوعة. تعكس ثقافة العمل في الرياض مزيجًا من التقاليد المحلية والمعايير الدولية، مع التركيز على الاحترافية والتفاني. يمكن للموظفين أن يتوقعوا بيئة عمل منظمة، حيث تُقدر العلاقات المهنية القوية. يمثل التنقل في الرياض جزءًا أساسيًا من الحياة اليومية، وتوفر المدينة خيارات سكنية متنوعة تناسب مختلف أنماط الحياة. غالبًا ما تبحث الشركات الكبرى، سواء كانت محلية أو عالمية، عن الكفاءات في الرياض، مما يساهم في تعزيز التنافسية والابتكار في سوق العمل.

موقع تجميع وظائف من جهات خارجية. الحقول المنظَّمة (المهام، المتطلبات، المزايا، التعليم، الراتب، الأسئلة) مُستنبَطة آلياً من الإعلان الأصلي وقد تكون غير دقيقة. يُرجى التحقّق عبر الموقع الرسمي لصاحب العمل قبل التقديم.

5k - 8k ريال سعودي نُشرت منذ 1 شهر