اتهامات لميتا بتضليل المستخدمين في تقييم أداء نموذجها الجديد للذكاء الاصطناعي

تواجه شركة ميتا انتقادات حادة بسبب مزاعم حول تقديم تقييمات مضللة لأداء نموذج الذكاء الاصطناعي الجديد “Maverick”.
وفقًا لتقرير نشره موقع “TechCrunch” واطلعت عليه “صدى تبوك”، أظهرت ميتا أن Maverick يحتل المرتبة الثانية في اختبار “LM Arena”، حيث يقوم مقيمون بشريون بمقارنة مخرجات النماذج وتفضيل الأفضل بينها.
ومع ذلك، تشير التقارير إلى أن النسخة المستخدمة في هذا الاختبار تختلف عن النسخة المتاحة للمطورين.
أوضحت ميتا في إعلانها أن النسخة المستخدمة في LM Arena هي “نسخة تجريبية محسّنة للمحادثات” من Maverick.
هذا التباين يثير تساؤلات حول مصداقية تقييمات الأداء، حيث أن تخصيص نموذج معين لاختبار محدد دون إتاحته للجمهور يمكن أن يؤدي إلى فهم غير دقيق لقدرات النموذج في الاستخدامات العملية.
يأتي هذا الجدل في سياق أوسع يتناول موثوقية معايير تقييم نماذج الذكاء الاصطناعي.
وأشارت تقارير سابقة إلى أن بعض النماذج قد تم تدريبها باستخدام بيانات من اختبارات تقييم شائعة، مما قد يؤدي إلى نتائج غير موثوقة.
يسلط هذا الضوء على الحاجة إلى تطوير معايير تقييم أكثر دقة وشفافية في مجال الذكاء الاصطناعي.
وحتى الآن، لم تصدر ميتا تعليقًا رسميًا حول هذه الادعاءات.




