جوجل تختبر منهجية جديدة لمعالجة أزمة الثقة في معايير تقييم الذكاء الاصطناعي
تقول جوجل ديبمايند إنها تطلق أول تقييم مزدوج التعمية لنموذج ذكاء اصطناعي متقدم تملكه، بهدف منع النماذج من معرفة أسئلة الاختبار مسبقًا. وفي المشروع التجريبي، تختبر جوجل نموذجًا من عائلة Gemini Flash Lite على معايير تقييم سرية، بالتعاون مع معهد سنغافورة لسلامة الذكاء الاصطناعي وشركاء آخرين. تُحفظ بيانات الاختبار وأوزان النموذج داخل بيئة مشفّرة، فلا يرى المقيّم الأوزان ولا ترى جوجل أسئلة الاختبار. وتستهدف المنهجية اختبارات شديدة الحساسية، مثل الأمن السيبراني والتقييمات الحكومية، مع عرض التفاصيل والنتائج في تقرير تقني.
الحقائق الأساسية
تستخدم جوجل بيئة Confidential Space من محفظة الحوسبة السرية في Google Cloud لتنفيذ التقييم.
«Google uses Confidential Space from Google Cloud's confidential computing portfolio to do it.»
عرض المصدر ←يحمي التصميم بيانات الاختبار وأوزان النموذج، بحيث لا يطّلع أي طرف على بيانات الطرف الآخر.
«The evaluator never sees the Gemini weights, and Google never sees the test prompts.»
عرض المصدر ←تقول ديبمايند إن المنهجية تناسب خصوصًا التقييمات الحساسة في الأمن السيبراني والجهات الحكومية.
«Deepmind says this matters most for highly sensitive evaluations, such as cybersecurity or tests run by government agencies.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر