أوبن أيه آي تطلق نموذج GPT-6 Astra بقدرات رياضية متقدمة
طرحت أوبن إيه آي نموذج GPT-6 Astra، الذي تصدّر اختبارًا لمسائل الرياضيات المفتوحة رغم أن الشركة لم تخصّص تطويره لهذا المجال. شمل الاختبار ٢٢٦ مسألة، حلّ النموذج ١٠٦ منها بالكامل في ٤٣، ودحض ٢٧ أخرى. وتفوّق Astra على Sol في عدد المسائل المحلولة، كما بدا أقوى في الكتابة العلمية وأقل ميلًا إلى المبالغة. ويقول كبير العلماء جاكوب باتشوكي إن أوبن إيه آي فضّلت توجيه جهودها إلى تحسين ذاتي متكرر وأبحاث مواءمة الأنظمة المستقبلية، لا إلى تحسين الرياضيات تحديدًا.
الحقائق الأساسية
سجّل GPT-6 Astra نتيجة 3.23 في ErdosBench، الذي يضم ٢٢٦ مسألة رياضية مفتوحة مستوحاة من مسائل إيردوش.
«The benchmark covers 226 open math problems inspired by the famous Erdős problems. Astra scored 3.23 and solved 106 problems, 43 of them completely.»
عرض المصدر ←حلّ Astra عددًا أكبر من المسائل مقارنةً بـSol، الذي بلغ حدّه الأقصى ٧٨ مسألة محلولة.
«Compared to Sol, which solved 78 problems at maximum reasoning, Astra showed stronger scientific writing and was less prone to overblown claims.»
عرض المصدر ←تقول أوبن إيه آي إنها لم تعطِ الأولوية لتحسين النموذج في أبحاث الرياضيات، وركّزت بدلًا من ذلك على التحسين الذاتي المتكرر وأبحاث مواءمة الذكاء الاصطناعي.
«OpenAI chief scientist Jakub Pachocki writes, "[…] we believe we could make the models better at specifically mathematics research with additional focus, but we do not prioritize this direction because of the urgency we feel about RSI and automated alignment research, as I will discuss later."»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر