← كل الأخبار
تقنية وعالم٣١ أغسطس ٢٠٢٦

تجربة: وكلاء الذكاء الاصطناعي يفشلون في إنتاج أبحاث علمية مقبولة

شارك

خاض وكلاء الذكاء الاصطناعي تجربةً لإنتاج أبحاث علمية، فكتبوا ورقتين رُفضتا كلتاهما، بحسب منشور @rohanpaul_ai على إكس. مُنحت الوكلاء ٦ أيام و٣ آلاف دولار، ثم قيّم ما كتبوه أشخاص أمضوا أشهرًا في دراسة الأسئلة نفسها. ويعزو المنشور الإخفاق إلى ضعف الحكم، بينما استندت التجارب الأساسية إلى Claude Opus 4.8 مع تفعيل استدلال مرتفع جدًا على OpenClaw.

الحقائق الأساسية

  • حصل وكلاء الذكاء الاصطناعي على ٦ أيام و٣ آلاف دولار لإنتاج أبحاث علمية، وانتهت المحاولة بورقتين مرفوضتين.

    «Given 6 days and $3K AI agents, produced 2 research papers, and both were rejected.»
    عرض المصدر ←
  • قيّم ما كتبته الوكلاء أشخاص أمضوا أشهرًا على الأسئلة البحثية نفسها، ووُصفت المشكلة الأساسية بأنها قصور في الحكم.

    «The failure was judgment.»
    عرض المصدر ←
  • اعتمدت التجارب الأساسية على Claude Opus 4.8 مع استدلال مرتفع جدًا عبر OpenClaw.

    «The main runs used Claude Opus 4.8 with extra-high reasoning on the OpenClaw»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر
تجربة: وكلاء الذكاء الاصطناعي يفشلون في إنتاج أبحاث علمية مقبولة — رادار