تقنية وعالم١ أغسطس ٢٠٢٦
دراسة: فشل وكلاء الذكاء الاصطناعي في إنتاج أبحاث علمية مقبولة

في اختبار لوكلاء الذكاء الاصطناعي، مُنحت الأنظمة ستة أيام وميزانية قدرها 3 آلاف دولار لإنتاج أبحاث علمية، فخرجت بورقتين رُفضتا كلتاهما. الباحثون الذين أمضوا أشهرًا في دراسة الأسئلة نفسها قيّموا ما كتبه الوكلاء. ووفقًا للنتيجة، لم تكن المشكلة في إنتاج النص، بل في القدرة على الحكم العلمي.
الحقائق الأساسية
حصل وكلاء الذكاء الاصطناعي على ستة أيام و3 آلاف دولار لإعداد أبحاث علمية.
«AI agents given 6 days and $3K produced two research papers, and both were rejected.»
عرض المصدر ←أنتج الوكلاء ورقتين بحثيتين، ورُفضت الورقتان.
«AI agents given 6 days and $3K produced two research papers, and both were rejected.»
عرض المصدر ←قيّم النتائج أشخاص أمضوا أشهرًا في دراسة الأسئلة البحثية نفسها، وخلصت التجربة إلى أن الإخفاق كان في الحكم.
«The people who had spent months on those questions graded what the AI agent wrote. The failure was judgment.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر