انضم إلى مشروع سبيرمنت، وهي مبادرة لتقييم ردود أنظمة الذكاء الاصطناعي متعددة اللغات تقوم بمراجعة مخرجات نماذج اللغات الكبيرة (LLM) عبر لغات مختلفة، مع التركيز على إما النبرة أو السلاسة. يجب أن تكون متحدثًا أصليًا بمستوى عالٍ في لغة الهدف، وأن تمتلك فهمًا قويًا للغة الإنجليزية.
كمقيّم، ستراجع مجموعات بيانات قصيرة تم تقسيمها مسبقًا، وتقيّم ردودًا توليدية ينتجها النموذج وفق معايير جودة محددة. سيسهم عملك في التحقق من صحة أطر التقييم ووضع مستويات جودة أساسية للتحسينات المستقبلية على النماذج.
المسؤوليات الرئيسية:
– قيّم ردود النموذج بلغتك الأم، مع التركيز على إما النبرة أو السلاسة.
– احكم على الجودة العامة ودقة المعلومات وطبيعية كل رد.
– اقرأ نص طلب المستخدم وردّي النموذج، ثم قيّم كل رد على مقياس من خمس درجات.
– قدّم تبريرات مختصرة لأي تقييمات مرتفعة أو منخفضة بشكل غير معتاد.
نظرة عامة على المشروع:
الدفعة 1 – النبرة: تحديد ما إذا كانت الردود مفيدة وثرية ومشوقة وعادلة. علّم أي مشكلات مثل استخدام صيغ رسمية غير مناسبة، أو أسلوب متعالٍ، أو تحيز، أو غير ذلك من المشكلات المتعلقة بالنبرة.
الدفعة 2 – السلاسة: التحقق من صحة القواعد النحوية، والوضوح، والترابط، ومدى انسيابية الرد.
هذه فرصة عمل قائمة على المشروع عبر CrowdGen. إذا تم اختيارك، ستقوم CrowdGen بإرسال تعليمات عبر البريد الإلكتروني لإنشاء حساب باستخدام عنوان بريدك الإلكتروني المستخدم في طلب التقديم. ستحتاج إلى تسجيل الدخول وإعادة تعيين كلمة المرور وإكمال متطلبات الإعداد، ثم متابعة طلبك للوظيفة.
سهم في تشكيل مستقبل الذكاء الاصطناعي—قدّم اليوم وشارك من منزلك.
٣٫٧٠–٣٫٧٠ دولارًا أمريكيًا في الساعة
To apply for this job, please visit the application page
