تخطى إلى المحتوى

وظائف بلس — مهندس ذكاء اصطناعي خلفي أول - تقييم جودة الوكيل

وظيفة منشورة على وظائف بلس، مع تفاصيل المتطلبات والمزايا ورابط التقديم المباشر.

🔔 تنبيهات على Telegram
سلة

سلة

Information Technology & Services مقر Makkah, Saudi Arabia
مكة المكرمة

مهندس ذكاء اصطناعي خلفي أول - تقييم جودة الوكيل

5-10
زيارة موقع الشركة

الإعلان الأصلي للوظيفة

Senior AI Backend Engineer - Agent Evaluation & Quality Salla

0

مقارنة الرواتب

تقديري ~24,000 ريال سعودي

تقدير مبني على بيانات إقليمية، وليس عرضًا رسميًا من جهة العمل.

الوصف

عن الدور نحن ندير أنظمة متعددة الوكلاء في الإنتاج تتعامل مع عمل حقيقي لقاعدة كبيرة من المستخدمين. مع نمو هذه الأنظمة، فإن أكبر قيودنا هو الثقة: نحتاج إلى معرفة مدى جودة أداء الوكلاء، واكتشاف الانحدارات قبل شحنها، والحفاظ على جودة ثابتة أثناء الإصدار. هذا الدور يمتلك ذلك. ستقوم ببناء أنظمة التقييم خلف وكلائنا - الحكام، وأدوات الاختبار، والمحاكيات التي تخبرنا ما إذا كان الوكيل يعمل وأين يفشل. الهدف هو تمكيننا من شحن الوكلاء بشكل أسرع لأننا نثق بما يخبرنا به التقييم. التقييم هو التركيز، لكنه لن يكون الحد. نظرًا لأنك ستفهم أوضاع فشل الوكلاء أفضل من أي شخص آخر، ستكون هناك أيضًا فرص للمساهمة في تطوير الوكيل نفسه، وبناء وتحسين الوكلاء جنبًا إلى جنب مع الأنظمة التي تقيمهم. المسؤوليات امتلاك مكدس التقييم. تصميم وبناء أنظمة LLM-as-judge، ومعايرتها مقابل التسميات البشرية، وجعل جودة الوكيل قابلة للقياس لكل وكيل ولكل وضع فشل. جعل بوابة الإصدار حقيقية. بناء أدوات تقييم لكل طلب سحب (PR) واكتشاف الانحدار المتصل بـ CI، بحيث يتم فرض الجودة تلقائيًا، وليس عن طريق التمريرات اليدوية. بناء محاكيات المستخدم لتوليد تغطية الاختبار والحالات العدائية قبل أن يواجهها المستخدمون الحقيقيون. تحويل إشارة الإنتاج إلى تحسين - إعادة توجيه الإخفاقات الحقيقية إلى مجموعات التقييم بحيث يتضاعف النظام بمرور الوقت. الشراكة مع المنتج لتحويل "ما يبدو جيدًا" إلى معايير ملموسة وقابلة للقياس. النمو في تطوير الوكيل - المساهمة في بناء وتقوية الوكلاء أنفسهم، بدءًا من المكونات التي تعرفها بعمق من تقييمها. أساسيات هندسة البرمجيات القوية. Python أو Typescript للإنتاج (أو ما شابه)، تصميم واجهة برمجة تطبيقات ونظام نظيف، اختبار، CI/CD. أنت تكتب تعليمات برمجية يبني عليها الآخرون - البنية التحتية للتقييم هي هندسة حقيقية. خبرة عملية في LLM/الوكيل. لقد قمت بالبناء باستخدام LLMs - الوكلاء، RAG، استدعاء الأدوات/الوظائف، أطر التنسيق (LangGraph، LangChain، أو ما يعادلها) - وتفهم كيف تتصرف وتتعطل. عقلية القياس. أنت تفكر في المقاييس والمعايرة والتجارب؛ تريد تحديد ما إذا كان شيء ما يعمل، وليس مجرد شحنه. خبرة الإنتاج. لقد قمت بتشغيل أنظمة LLM في الإنتاج وتعاملت مع الموثوقية، زمن الوصول، التكلفة، وإمكانية المراقبة. 5+ سنوات من هندسة البرمجيات، مع عمل حديث وعملي في LLM/الوكيل. مزايا إضافية خبرة مباشرة في تقييم أنظمة LLM/الوكيل - التقييم دون اتصال/عبر الإنترنت، LLM-as-judge، اختبار الانحدار المنهجي. أدوات المراقبة (Arize، LangSmith، أو ما شابه). خبرة في اللغة العربية / معالجة اللغة الطبيعية (NLP). خبرة في التجارة الإلكترونية أو المنتجات الموجهة للتجار.

ما ستقوم به

  • - تصميم وبناء أنظمة التقييم، بما في ذلك LLM-as-judge وأدوات الاختبار، لقياس جودة الوكيل ومنع الانحدارات. تطوير محاكيات المستخدم ودمج بوابات الجودة الآلية في خط أنابيب CI لتسريع نشر الوكيل.

المتطلبات

يتطلب 5+ سنوات من الخبرة في هندسة البرمجيات مع عمل حديث وعملي في وكلاء LLM، RAG، وأطر التنسيق. يجب أن يمتلك أساسيات قوية في Python أو Typescript وعقلية تعتمد على القياس لتحديد أداء النظام كميًا.

نسبة التوافق17%

نصائح المقابلة

استعد لمناقشة خبرتك في بناء أنظمة تقييم الوكلاء، خاصةً باستخدام LLM-as-judge وكيف قمت بمعايرتها.

كن مستعدًا لمشاركة أمثلة محددة عن كيفية تعاملك مع تحديات الموثوقية، زمن الوصول، التكلفة، وإمكانية المراقبة في أنظمة LLM الإنتاجية.

سلط الضوء على فهمك لـ LangGraph أو LangChain أو أطر عمل التنسيق المماثلة، وكيف استخدمتها في مشاريعك السابقة.

أظهر عقلية القياس لديك من خلال مناقشة كيفية تحديد المقاييس، وإجراء المعايرة، وتصميم التجارب لتقييم أداء الوكيل.

اقتراح آلي للمسار الوظيفي، وليس توصية رسمية من صاحب العمل.

المسار الوظيفي

نقطة الدخول

مهندس ذكاء اصطناعي رئيسي

الدور الحالي

مهندس ذكاء اصطناعي خلفي أول - تقييم جودة الوكيل

الخطوة التالية

مهندس تعلم آلة رئيسي

الخطوة التالية

مدير هندسة الذكاء الاصطناعي

الأسئلة الشائعة

ما هو الدور الرئيسي لمهندس الذكاء الاصطناعي الخلفي الأول في تقييم جودة الوكيل؟

الدور الرئيسي هو امتلاك أنظمة التقييم خلف وكلاء Salla، بما في ذلك تصميم وبناء أنظمة LLM-as-judge، وأدوات الاختبار، والمحاكيات لضمان جودة أداء الوكلاء واكتشاف الانحدارات قبل شحنها.

ما هي المهارات التقنية الأساسية المطلوبة لهذا الدور؟

يتطلب الدور أساسيات قوية في هندسة البرمجيات، وخبرة في Python أو Typescript، وتصميم واجهة برمجة تطبيقات ونظام نظيف، واختبار، وCI/CD. كما تتطلب خبرة عملية في LLM/الوكيل، بما في ذلك RAG، واستدعاء الأدوات/الوظائف، وأطر التنسيق مثل LangGraph أو LangChain.

ما هي الخبرة المطلوبة لهذا المنصب؟

يتطلب المنصب 5+ سنوات من الخبرة في هندسة البرمجيات، مع عمل حديث وعملي في LLM/الوكيل. الخبرة في تشغيل أنظمة LLM في الإنتاج والتعامل مع الموثوقية، زمن الوصول، التكلفة، وإمكانية المراقبة ضرورية أيضًا.

هل هناك أي مهارات إضافية مرغوبة لهذا الدور؟

نعم، تشمل المهارات الإضافية المرغوبة الخبرة المباشرة في تقييم أنظمة LLM/الوكيل (التقييم دون اتصال/عبر الإنترنت، LLM-as-judge، اختبار الانحدار المنهجي)، وأدوات المراقبة (Arize، LangSmith، أو ما شابه)، وخبرة في اللغة العربية / معالجة اللغة الطبيعية (NLP)، وخبرة في التجارة الإلكترونية أو المنتجات الموجهة للتجار.

العمل في مكة المكرمة

تتميز مكة المكرمة كمركز ديني واقتصادي هام في المملكة العربية السعودية، وتوفر بيئة عمل فريدة تتأثر بطابعها الروحي. يتركز الاقتصاد المحلي بشكل كبير حول الخدمات المرتبطة بالحج والعمرة، مما يخلق فرص عمل في قطاعات الضيافة، التجارة، الخدمات اللوجستية، وإدارة المرافق. سوق العمل في مكة المكرمة يتسم بالديناميكية، حيث تستقطب المدينة الكفاءات من داخل المملكة وخارجها، خاصة خلال مواسم الذروة. تتطلب بيئة العمل هنا غالبًا التزامًا بالقيم الثقافية والدينية للمدينة، مع التركيز على خدمة الزوار والمقيمين. الشركات الكبرى والصغيرة على حد سواء تبحث عن موظفين ملتزمين ومتحمسين للمساهمة في تطوير المدينة وخدمة ضيوف الرحمن.

موقع تجميع وظائف من جهات خارجية. الحقول المنظَّمة (المهام، المتطلبات، المزايا، التعليم، الراتب، الأسئلة) مُستنبَطة آلياً من الإعلان الأصلي وقد تكون غير دقيقة. يُرجى التحقّق عبر الموقع الرسمي لصاحب العمل قبل التقديم.

نُشرت منذ 21 يوم