← كل الأخبار
الذكاء الاصطناعي١٤ أغسطس ٢٠٢٦

دراسة تشكك في قدرة الذكاء الاصطناعي على البحث المستقل

شارك
دراسة تشكك في قدرة الذكاء الاصطناعي على البحث المستقل

اختبرت ورقة من برينستون ومعهد أمن الذكاء الاصطناعي في المملكة المتحدة قدرة وكلاء الذكاء الاصطناعي على إجراء أبحاث مستقلة، وخلصت إلى أنهم ينجحون هندسيًا لكنهم يتعثرون في الحكم البحثي. اعتمد الاختبار على سؤالين من ورقتين غير منشورتين في NeurIPS، كي لا تستند الوكلاء إلى بيانات التدريب، ثم قيّم أصحاب الورقتين النتائج كمراجعي مؤتمرات. حصل كل وكيل على ٦ أيام و٣ آلاف دولار من أرصدة واجهات البرمجة، إضافة إلى وحدة معالجة رسومية وبيئة افتراضية والويب المفتوح، لكن الورقتين رُفضتا. وتمكنت الوكلاء من البحث والبرمجة وتشغيل التجارب دون مساعدة بشرية تُذكر، إلا أنها أخفقت في اختيار التجارب المناسبة ومتابعة التعليمات ومعالجة الانتقادات الأساسية.

الحقائق الأساسية

  • شغّلت التجارب الأساسية Claude Opus 4.8 مع تفعيل أعلى مستوى من الاستدلال، ضمن بيئة تنسّق استدعاءات النموذج وتتيح تفويض المهام لوكلاء فرعيين.

    «The main experiments used Claude Opus 4.8 with Extra-High Reasoning.»
    عرض المصدر ←
  • رفض أصحاب الورقتين النتائج بعد مراجعتها، وحصلت إحداهما على تصنيف «رفض قوي» بسبب مشكلات في البيانات والتجارب والكتابة وغياب الإسهام الجديد.

    «The original authors reviewed the finished papers as conference reviewers and rejected both. One got a "Strong Reject."»
    عرض المصدر ←
  • لم يحتج الوكلاء إلا إلى ثلاثة تدخلات بشرية: إصلاح خلل في بيئة التشغيل، وتمديد المهلة، وطلب إعادة الكتابة لتحسين الوضوح.

    «Only three human interventions were needed: a scaffold bug fix, a deadline extension, and a request to rewrite for readability.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر