الذكاء الاصطناعي١٣ أغسطس ٢٠٢٦
منصة Arena تطلق أداة AutoEval لتقييم تفضيلات المستخدمين آليًا

قدّمت Arena أداة AutoEval لتقدير تفضيلات البشر آليًا على نطاق واسع. وتدرّب الأداة نموذج مكافآت باستخدام عشرات الملايين من مواجهات Arena التاريخية التي خاضها بشر، لتقديم نتائج التقييم بسرعة تضاهي أحدث الأنظمة. وعلى خلاف أساليب التحكيم بنماذج اللغة الكبيرة، تصف Arena AutoEval بأنه معيار حيّ للتقييم.
الحقائق الأساسية
تعتمد AutoEval على عشرات الملايين من مواجهات Arena السابقة بين البشر لتدريب نموذج المكافآت.
«Arena AutoEval uses tens of millions of historical Arena battles from humans, to train a reward model that can estimate human preferences at scale, and deliver evaluation results at frontier speed.»
عرض المصدر ←تقدّر الأداة تفضيلات البشر على نطاق واسع وتنتج نتائج التقييم بسرعة تضاهي أحدث الأنظمة.
«Arena AutoEval uses tens of millions of historical Arena battles from humans, to train a reward model that can estimate human preferences at scale, and deliver evaluation results at frontier speed.»
عرض المصدر ←تختلف AutoEval عن أساليب التحكيم التي تستخدم نماذج اللغة الكبيرة، إذ تُقدَّم بوصفها معيارًا حيًا.
«Unlike LLM-as-judge methods, AutoEval remains a live benchmark: it is derived https://t.co/C1xgKijWoq»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر