ميسترال تطلق نموذج Shieldstral للأمان بحجم صغير

أتاحت شركة ميسترال الفرنسية نموذج Shieldstral المفتوح، الذي يتيح للمشغّلين تحديد قواعد فحص السلامة لحظيًا عبر أسئلة بنعم أو لا، من دون إعادة تدريب المصنّف. ويضم النموذج ٣ مليارات معلمة، وتقول الشركة إنه يحقق نتيجة جديدة مرتفعة في تصنيف النصوص والصور معًا، بينما خلصت الورقة إلى أنه يضاهي نماذج أكبر بثلاث مرات في اختبارات سلامة النصوص. سجل Shieldstral درجة F1 بلغت ٨٤٫٩٪ في اختبارات النصوص، و٨٣٫٨٪ في الصور ومزيج النص والصورة، كما تفوق على نماذج أكبر في بعض المقارنات. وهو متاح بأوزان مفتوحة بموجب ترخيص Apache 2.0، ويعيد إجابة من كلمة واحدة، ما قد يقلل كلفة التشغيل مقارنةً بأنظمة تولّد سلاسل استدلال طويلة.
الحقائق الأساسية
اعتمد Shieldstral على نموذج Ministral-3B مع مُرمّز الرؤية Pixtral، ورفع تدريب الفئات الاصطناعية درجة F1 بمقدار ٢٣٫٣ نقطة مئوية في اختبار للفئات الدقيقة.
«Shieldstral is based on Mistral's Ministral-3B with the Pixtral vision encoder. In a validation test with fine-grained categories, synthetic category data raised the F1 score by 23.3 percentage points, which the researchers say was the main driver of the model's ability to adapt to new rules.»
عرض المصدر ←في معيار قابلية التكيف، سجل Shieldstral نسبة ٩١٫٣٪، مقابل ٩٤٫١٪ لنموذج GPT-OSS-Safeguard-20B الأكبر حجمًا.
«GPT-OSS-Safeguard-20B leads the adaptability benchmark with 94.1 percent, compared with Shieldstral's 91.3 percent.»
عرض المصدر ←يتاح النموذج بأوزان مفتوحة وفق ترخيص Apache 2.0.
«Shieldstral is available as an open-weight model under the Apache 2.0 license.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر