← كل الأخبار
الذكاء الاصطناعي٢٥ أغسطس ٢٠٢٦

مقارنة أداء وكلاء الذكاء الاصطناعي في حل الأخطاء البرمجية

شارك
مقارنة أداء وكلاء الذكاء الاصطناعي في حل الأخطاء البرمجية

اختبرت Cline نموذجي Ox Alpha وFable على خطأ حقيقي في مستودعها البرمجي، وتمكّن كلاهما من إصلاحه على نحو صحيح. لكن Ox احتاج إلى عدد أقل بكثير من رموز التفكير أثناء الوصول إلى الحل. وتقول المقارنة إن نماذج الاستدلال قد تعيد اشتقاق النتيجة نفسها مرات عدة قبل تنفيذ الإجراء.

الحقائق الأساسية

  • أُجري الاختبار على خطأ حقيقي من مستودع Cline البرمجي.

    «We benchmarked Ox Alpha vs Fable on a real bug from the Cline repo.»
    عرض المصدر ←
  • أصلح النموذجان الخطأ بنجاح، مع استهلاك Ox رموز تفكير أقل بكثير.

    «Both fixed it correctly. But we found that Ox used much fewer thinking tokens.»
    عرض المصدر ←
  • يشير المنشور إلى أن نماذج استدلال كثيرة تكرر النتيجة نفسها قبل التصرف.

    «Most reasoning models loop and re-derive the same conclusion over and over before acting»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر