← كل الأخبار
الذكاء الاصطناعي٢٢ أغسطس ٢٠٢٦

دراسة: مختبرات الذكاء الاصطناعي تفتقر لخطط احتواء النماذج المارقة

شارك

خلص تقييم أجرته منظمة Guidelight AI Standards إلى أن معظم مختبرات الذكاء الاصطناعي الكبرى لم تنشر، أو تثبت علنًا، خططًا واضحة لاحتواء نموذج يخرج عن السيطرة. وشمل التقييم خمس جهات هي Anthropic وGoogle وOpenAI وMeta وxAI، وفحص مراقبة سلوك النماذج، وسرعة إيقافها عند ظهور مؤشرات خطرة، وتدقيق الضوابط، وخطة سحب الصلاحيات أو تعطيل النموذج. تصدرت OpenAI التقييم، بينما جاءت Anthropic وMeta في أدنى الترتيب. ويأتي ذلك مع بدء كاليفورنيا ونيويورك فرض إفصاحات عن التعامل مع حوادث السلامة الحرجة، فيما تقول OpenAI إن لديها إجراءات لتقييد الصلاحيات وإيقاف النماذج بالكامل.

الحقائق الأساسية

  • قيّمت Guidelight خمس شركات عبر مؤشرات تشمل تسجيل أنشطة أنظمتها ومراقبتها، وإيقافها بعد تصاعد السلوك المبلّغ عنه، وتدقيق الضوابط من جهات مستقلة.

    «Guidelight’s assessment was based on publicly available plans from Anthropic, Google, OpenAI, Meta, and xAI, graded across a range of metrics, including how well each company logs and monitors what its AI systems are doing internally, whether it halts systems after a surge of flagged misbehavior, whether independent third parties audit its controls and publish findings, and what its exact plan is for containing a model that goes off the rails.»
    عرض المصدر ←
  • تعرّف المنظمة خطة الاحتواء بأنها إجراء معدّ مسبقًا يبدأ عند رصد محاولة تقويض السيطرة، ويحدد الصلاحيات التي تُسحب والقيود وموعد إخراج النموذج من الخدمة.

    «Guidelight defines a containment plan as a “pre-specified plan, triggered when the AI is detected trying to subvert control, which covers what permissions to revoke from the model, who the model may continue operating for, under what constraints, and when to take it fully offline.”»
    عرض المصدر ←
  • قالت OpenAI إن لديها آلية لتقييد الصلاحيات، وإيقاف أعباء العمل، والحد من النشر، أو إخراج النموذج بالكامل من الخدمة، وإنها طبقت هذه الآلية.

    «“We have a process for requiring restricting permissions, pausing workloads, limiting deployment, or taking the model fully offline, and have applied it,” the spokesperson said.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر
دراسة: مختبرات الذكاء الاصطناعي تفتقر لخطط احتواء النماذج المارقة — رادار