← كل الأخبار
الذكاء الاصطناعي٥ سبتمبر ٢٠٢٦

سكيل ويو سي بيركلي: تكلفة المراجعة البشرية معيار لتقييم الوكلاء

شارك

توضح ورقة من Scale AI وجامعة كاليفورنيا أن وكيلين للذكاء الاصطناعي قد يحققان نتيجة متقاربة، لكنهما يحتاجان إلى قدر مختلف جدًا من المراجعة البشرية. وتقترح الورقة أن ترتّب فرق المؤسسات الوكلاء بحسب تكلفة تشغيلهم بصورة موثوقة، لا بحسب دقة اختبارات المقارنة وحدها. ويقيّم إطار READY الوكيل مع عملية المراجعة البشرية المحيطة به.

الحقائق الأساسية

  • قد يتقارب أداء وكيلين، رغم اختلاف احتياجهما إلى المراجعة البشرية بدرجة كبيرة.

    «Scale AI + Univ of California paper shows 2 agents can score almost the same yet need very different human review»
    عرض المصدر ←
  • يقيس READY الوكيل إلى جانب المراجعة البشرية المرتبطة بتشغيله.

    «READY evaluates the agent together with the human review around»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر