منصة Code Arena توسع نطاق تقييماتها ليشمل قدرات التطوير الكامل (Full-stack)

أعلنت منصة Code Arena توسيع نطاق تقييماتها لتشمل قدرات التطوير الكامل بدلًا من اقتصارها على الواجهة الأمامية فقط، بحيث تقيس مهامًا متعددة الخطوات واستخدام الأدوات وتوليد التطبيقات من البداية إلى النهاية. وكشفت المنصة عن ترتيب جديد للنماذج الذكية في هذا المجال، تصدّره Kimi K3 بنسختها Max، يليه GPT 5.6 Sol بنسخة xHigh في المركز الثاني، ثم Claude Fable 5 في الثالث. ويُظهر التقييم أن المراكز تتغيّر جوهريًا عند الانتقال من مقارنة الواجهة الأمامية وحدها إلى فئة التطوير الكامل.
الحقائق الأساسية
وسّعت منصة Code Arena تقييماتها لتشمل قدرات التطوير الكامل، تقيس الاستدلال متعدد الخطوات واستخدام الأدوات وتوليد التطبيقات من البداية للنهاية
«Code Arena now measures fullstack capabilities! View overall rankings across AI models on full-stack web development tasks: multi-step reasoning, tool use, and end-to-end app generation.»
عرض المصدر ←تصدر نموذج Kimi K3 نسخة Max الترتيب العام، يليه GPT 5.6 Sol نسخة xHigh ثانيًا، ثم Claude Fable 5 ثالثًا
«- Kimi K3 (Max) takes #1 - GPT 5.6 Sol (xHigh) at #2 - Claude Fable 5 at #3»
عرض المصدر ←تتغير المراكز بين النماذج عند الانتقال من فئة الواجهة الأمامية فقط إلى فئة التطوير الكامل
«Comparing frontend-only to fullstack categories, rankings shift.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر