← كل الأخبار
الذكاء الاصطناعي١١ أكتوبر ٢٠٢٦

دراسة: فِرق وكلاء الذكاء الاصطناعي تستهلك موارد ضخمة دون تحسن ملموس

شارك
دراسة: فِرق وكلاء الذكاء الاصطناعي تستهلك موارد ضخمة دون تحسن ملموس

اختبرت شركة التقييم Vals AI أداء GPT-6 Sol وClaude Opus 5.5 منفردَين وضمن فرق، ووجدت أن الفرق لا تحسّن النتائج غالبًا بما يوازي كلفتها. تراوحت كلفة تشغيل الفرق بين ١٫٨ و٥٫١ أضعاف كلفة الوكلاء المنفردين، ولم يظهر تحسّن ذو دلالة إحصائية إلا في مقارنة واحدة من أربع. وفي تلك المقارنة، تفوّق فريق GPT-6 Sol عند مستوى الاستدلال المتوسط بـ٧٫٣ نقاط؛ أما عند أقصى مستوى للاستدلال فلم تحقق الفرق ميزة فعلية لأي من النموذجين.

الحقائق الأساسية

  • بلغت كلفة فرق الوكلاء ١٫٨ إلى ٥٫١ أضعاف كلفة الوكلاء المنفردين.

    «The teams cost between 1.8x and 5.1x more than single agents.»
    عرض المصدر ←
  • سجّل فريق GPT-6 Sol عند مستوى الاستدلال المتوسط تحسنًا قدره ٧٫٣ نقاط.

    «Out of four comparisons between teams and solo agents, only one showed a statistically significant improvement: GPT-6 Sol at medium reasoning, where the team scored 7.3 points higher.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر