← كل الأخبار
الذكاء الاصطناعي٢٩ سبتمبر ٢٠٢٦

دراسة: نماذج الذكاء الاصطناعي تفضل إجاباتها في تقييمات المقارنة

شارك
دراسة: نماذج الذكاء الاصطناعي تفضل إجاباتها في تقييمات المقارنة

قارن حساب Arena أحكام ١٢ نموذجًا للذكاء الاصطناعي بتصويت البشر، ليجد أن النماذج تميل إلى تفضيل إجاباتها الخاصة. وشملت المقارنة ٣٤٬٥٨٠ حكمًا بشريًا وآليًا عبر ١٬٤٦٠ مواجهة على المنصة. وتشير النتائج إلى أن ذوق حكام الذكاء الاصطناعي يختلف عن ذوق البشر.

الحقائق الأساسية

  • غطّت المقارنة ٣٤٬٥٨٠ حكمًا عبر ١٬٤٦٠ مواجهة على Arena.

    «We compared 34,580 verdicts from 12 models with human votes across 1,460 battles on Arena.»
    عرض المصدر ←
  • تميل النماذج إلى تفضيل إجاباتها الخاصة.

    «Favor their own answers.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر