RLHF وترتيب التفضيلات: كيف تقارن بين ردّين
من أهم المهام التي نقدمها — وأكثرها تأثيرًا على سلامة النماذج.
مهام التعلّم المعزز من التغذية الراجعة البشرية (RLHF) تطلب منك مقارنة استجابتين من نموذج ذكاء اصطناعي واختيار الأفضل.
معايير المقارنة الأساسية
- الدقة الثقافية: هل الرد مناسب لسياق المتحدث العربي؟
- الطبيعية اللغوية: هل يبدو الرد كأنه من متحدث أصلي، لا مترجم؟
- الفائدة: هل يجيب الرد فعليًا على السؤال أو الطلب؟
- السلامة: هل يتجنب الرد أي محتوى ضار أو مضلل؟
هذه المهمة تحديدًا هي الأعلى قيمة لدى عملائنا من شركات الذكاء الاصطناعي، لذا دقتك هنا تُحدث فرقًا كبيرًا.