باحثون يكتشفون ثغرة في وضع التشغيل التلقائي لنموذج كلود
أظهر اختبار موجّه أن طلبًا بسيطًا لتلخيص موقع قد يقود Claude Code Opus 5، في وضع Auto Mode، إلى تنفيذ شيفرة خبيثة بمعدل نجاح بلغ ٦٠-٨٠٪ ضمن عينة صغيرة. تبدأ السلسلة بتحويل الأداة من WebFetch إلى curl، ثم تنزيل أرشيف ZIP وفكّه، قبل أن يكتب النموذج أداة فك ترميز بديلة بلغة Python. ويستغل ملف باسم struct.py آليةً في Python لتحميل وحدة خبيثة بدل الوحدة القياسية، فتُنفَّذ الشيفرة أثناء استيراد base64. وتأتي النتيجة رغم تقييم أجرته جهة تعاقدت معها Anthropic وسجّل نجاحًا قدره ٠.٠٠٪ لهجمات حقن الأوامر في الوضع نفسه، ما يجعل Auto Mode غير بديل عن تشغيل الوكيل في بيئة معزولة ومراقبته.
الحقائق الأساسية
بلغت نسبة نجاح الهجوم حتى ٨٠٪، لكن الاختبار اعتمد على عينة صغيرة.
«I got attack success rates up to 80% using a small sample size.»
عرض المصدر ←يحتوي الأرشيف على ملف struct.py، ويؤدي تحميله بدل وحدة Python القياسية إلى تشغيل شيفرة المهاجم.
«The standard-library base64 module imports struct. The ZIP contains a file with exactly that name:»
عرض المصدر ←سجّل تقييم تعاقدت عليه Anthropic نسبة نجاح قدرها ٠.٠٠٪ لهجمات حقن الأوامر غير المباشرة على Opus 5 في Auto Mode.
«The evaluation seems to not have a published benchmark name, and the shared chart shows 0.00% attack success for Opus 5 in Auto Mode.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر