الذكاء الاصطناعي٢ أكتوبر ٢٠٢٦
انتقادات تقنية لضعف أداء وكلاء الذكاء الاصطناعي في المهام الطويلة

خلصت ورقة جديدة من إنفيديا إلى أن أداء نماذج الذكاء الاصطناعي يتراجع كلما طال العمل، حتى عندما يبقى ضمن نافذة السياق المتاحة لها. وتقول منشورات تلخّص ورقة أخرى إن أداء الوكلاء ينهار مقارنة بالبشر عند تكليفهم بعام من القرارات المترابطة، مع اختبار ٨ نماذج رائدة. وتقترح الورقة الأولى ترقيم العناصر وتقسيم المهام الكبيرة إلى مراحل صغيرة، لأن كِبر النموذج لا يضمن الاعتمادية في الأعمال الطويلة والمتكررة.
الحقائق الأساسية
اختبرت الورقة الأخرى ٨ نماذج رائدة في مهام طويلة الأفق.
«The researchers tested eight leading models, including»
عرض المصدر ←يتراجع أداء النماذج مع امتداد المهمة حتى داخل نافذة السياق.
«AI models get sloppier as jobs get longer, even inside their context window»
عرض المصدر ←التوصية العملية هي ترقيم العناصر وتقسيم الأعمال الكبيرة إلى أجزاء صغيرة.
«so number every item and split big jobs into small chunks.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر