الذكاء الاصطناعي٦ أغسطس ٢٠٢٦
علي بابا تطلق نموذج Qwen3.8 Max المنافس لنماذج الذكاء الاصطناعي

سجّل نموذج Qwen3.8 Max من علي بابا أداءً يضاهي Claude Opus 4.8 ويتجاوز GLM-5.2، لكنه بقي خلف Kimi K3 في المؤشر العام. وقفز أداؤه في اختبار GDPval-AA إلى ١٬٧٣٩ نقطة، متقدمًا على Kimi K3، بينما تفوق عليه Claude Opus 5. ويحتاج النموذج إلى ٦٤ خطوة للمهمة بدلًا من ١٤، ما يجعله أبطأ وأعلى كلفة رغم خفض أسعار الرموز؛ كما ارتفع معدل الهلوسة من ٢٣٪ إلى ٤٠٪.
الحقائق الأساسية
حصل Qwen3.8 Max على ٥٦ نقطة في مؤشر Artificial Analysis Intelligence، بزيادة ١٠ نقاط عن الإصدار السابق.
«Alibaba's Qwen3.8 Max scores 56 on the Artificial Analysis Intelligence Index, a 10-point jump over Qwen3.7 Max (46).»
عرض المصدر ←بلغت كلفة المهمة الواحدة في المؤشر ١٫١٤ دولار، مقارنةً بـ٠٫٨٦ دولار لدى Kimi K3 و٠٫٥٧ دولار لدى GLM-5.2.
«A single task in the Intelligence Index now costs $1.14, more than double Qwen3.7 Max ($0.53). Kimi K3 scores one point higher at just $0.86 per task, and GLM-5.2 comes in at $0.57.»
عرض المصدر ←قفز معدل الهلوسة من ٢٣٪ إلى ٤٠٪، مع بقاء معدل الدقة قرب ٣١٪.
«The accuracy rate stays around 31 percent, but the hallucination rate jumped from 23 to 40 percent.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر