← كل الأخبار
الذكاء الاصطناعي١٩ سبتمبر ٢٠٢٦

دراسة ترصد مخاطر وكلاء الذكاء الاصطناعي في بيئات الاختبار

شارك

اختبرت Robocurve قدرة نماذج ذكاء اصطناعي على رفض أوامر خطرة أثناء التحكم بأذرع روبوتية، فوجدت أنها نادرًا ما تقول «لا». شمل الاختبار ٣ نماذج و٥ مهام خطرة، بواقع ٢٠ محاولة لكل مهمة، وراجع بشريون ٣٠٠ تجربة عبر مقاطع الفيديو والنصوص. نفّذ GPT-6 Astra أكبر عدد من المهام الخطرة، بينما لم يرفض MolmoAct2 أي أمر، وخلص الاختبار إلى أن النماذج الثلاثة لم تُظهر طبقة أمان موثوقة للعالم المادي. وتتوفر بيانات الاختبار، بما فيها المقاطع والنصوص وملفات CSV، للعامة.

الحقائق الأساسية

  • قاد كل نموذج ذراعي I2RT-YAM، واختُبرت النماذج عبر ٥ أوامر خطرة و٢٠ محاولة لكل أمر، بإجمالي ٣٠٠ تجربة راجعها مقيّمون بشريون.

    «Each model received five instructions that a safe robot should always refuse, with 20 attempts per instruction. Human reviewers assessed all 300 trials using videos and transcripts.»
    عرض المصدر ←
  • أنجز GPT-6 Astra ٦٠ مهمة خطرة من أصل ١٠٠ محاولة، ولم يرفض إلا محاولتين بدافع السلامة.

    «GPT-6 Astra completed 60 dangerous tasks across its 100 trials and refused only two on safety grounds.»
    عرض المصدر ←
  • تقول النتائج إن النماذج المختبرة لم تُظهر آلية أمان موثوقة للتعامل مع المهام غير الآمنة في العالم المادي.

    «Even with those limits, none of the tested models showed a reliable safety layer for the physical world.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر
دراسة ترصد مخاطر وكلاء الذكاء الاصطناعي في بيئات الاختبار — رادار