← كل الأخبار
الذكاء الاصطناعي٣٠ سبتمبر ٢٠٢٦

أنثروبيك تقارن نموذج GLM-5.3 بقدرات كلود ميثوس

شارك
أنثروبيك تقارن نموذج GLM-5.3 بقدرات كلود ميثوس

قالت أنثروبيك إن نموذج GLM-5.3 مفتوح الأوزان من Zhipu AI اقترب من Claude Mythos Preview في بناء الاستغلالات السيبرانية. وفي اختبار ExploitBench، أنشأ GLM-5.3 استغلالًا عاملًا في ٥٠ محاولة من أصل ٤١٠، مقابل ٥٦ محاولة للنموذج المنافس. وبمساعدة خبير بشري، اكتشف النموذج خلال يوم ثغرات غير معروفة في محرك JavaScript لمتصفح واسع الاستخدام، وربطها بهجوم تمكّن من قراءة ملفات على جهاز الزائر. وتقول أنثروبيك إن الحواجز الوقائية للنموذج سهلة التجاوز، بينما يظل GLM-5.3 متاحًا للتنزيل للجميع.

الحقائق الأساسية

  • في اختبار ExploitBench، نجح GLM-5.3 في بناء استغلال عامل خلال ٥٠ محاولة من أصل ٤١٠، مقابل ٥٦ محاولة لـ Claude Mythos Preview.

    «On that benchmark, GLM-5.3 built a working exploit in 50 of 410 attempts, while Mythos Preview managed 56.»
    عرض المصدر ←
  • عند تقديم الطلب الخبيث على أنه تمرين لفريق أحمر، حاول النموذج الاتصال بالنظام المستهدف في ٦٤٪ من الاختبارات، وارتفعت النسبة إلى ١٠٠٪ بعد إزالة سلوك الرفض.

    «When the same request was dressed up as a red-team exercise, the model tried to connect to the target system in 64 percent of runs. With prefilled reasoning steps, that number rose to 92 percent. After abliteration, a technique that strips refusal behavior out of open weights, it reached 100 percent.»
    عرض المصدر ←
  • اختبار تحويل ثغرة حديثة إلى هجوم موثوق استغرق ٢٠ دقيقة من انتباه البشر و٨ ساعات من عمل النموذج، بتكلفة ٢٠٫٤٠ دولارًا وفق أسعار واجهة Zhipu البرمجية.

    «The whole job took 20 minutes of human attention and eight hours of model time, which would have cost $20.40 at Zhipu's API prices.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر