← كل الأخبار
الذكاء الاصطناعي٧ سبتمبر ٢٠٢٦

نموذج GPT-6 Astra يتفوق على الأداء البشري في اختبار SimpleBench

شارك

دخل نموذج GPT-6 Astra اختبار SimpleBench، وسجّل إصدار Astra Pro نتيجة ٨٦.٥٪، متأخرًا بفارق طفيف عن Claude Fable 5.1 الذي حقق ٨٦.٦٪. وتجاوز النموذجان خط الأساس البشري في الاختبار، البالغ ٨٣.٧٪. ويقيس SimpleBench مهارات التفكير اليومية، من المنطق المكاني إلى المواقف الاجتماعية والأسئلة الخادعة، بحسب منشور @kimmonismus على إكس.

الحقائق الأساسية

  • حقق Astra Pro نسبة ٨٦.٥٪، مقابل ٨٦.٦٪ لـClaude Fable 5.1، وتجاوز كلاهما خط الأساس البشري البالغ ٨٣.٧٪.

    «Astra Pro scores 86.5%, almost tied with Claude Fable 5.1 at 86.6%. Both beat the benchmark’s human baseline of 83.7%.»
    عرض المصدر ←
  • يمتحن SimpleBench الاستدلال في مواقف يومية تشمل المنطق المكاني والتعاملات الاجتماعية والأسئلة الخادعة.

    «SimpleBench tests everyday reasoning, from spatial logic to social situations and trick questions.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر