← كل الأخبار
الذكاء الاصطناعي٢٨ أغسطس ٢٠٢٦

انتقادات تقنية لضعف أداء وكلاء الذكاء الاصطناعي في المهام الطويلة

شارك

اختبر باحثون ٨ نماذج رائدة في مهام تمتد لعام وتتطلب قرارات مترابطة، وتغذية راجعة متأخرة، والتعامل مع نتائج أفعال سابقة. ووفق منشور على إكس يلخّص ورقة الاختبار، تراجع أداء النماذج بشدة مقارنةً بالبشر. وتنسجم هذه النتيجة مع انتقاد شاماث لمهام الأفق الطويل، التي وصف أداء الذكاء الاصطناعي فيها بأنه لا يزال ضعيفًا.

الحقائق الأساسية

  • شمل الاختبار ٨ نماذج رائدة.

    «The researchers tested eight leading models, including https://t.co/6CPvVIQCQX https://t.co/rGBfuPZEtv»
    عرض المصدر ←
  • امتدت المهمة لعام وجمعت بين قرارات مترابطة وتغذية راجعة متأخرة ونتائج ناتجة عن أفعال سابقة.

    «Give an agent a year of interconnected decisions, delayed feedback, and consequences from its own past actions, and its performance collapses relative to humans.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر
انتقادات تقنية لضعف أداء وكلاء الذكاء الاصطناعي في المهام الطويلة — رادار