الذكاء الاصطناعي١٢ أغسطس ٢٠٢٦
علي بابا تطلق نموذج Qwen3.8 بـ 2.4 تريليون معامل

أصدرت Alibaba_Qwen نموذج Qwen3.8-2.4T-A95B مفتوح الأوزان، بوصفه من أكبر النماذج المتاحة بهذا الشكل حتى الآن. يضم النموذج ٢.٤ تريليون معامل، منها ٩٥ مليارًا نشطة، موزعة على ٥١٢ خبيرًا، مع دعم فوري في vLLM لأجهزة NVIDIA وAMD. وتقول UnslothAI إن تقليصه بتقنية Dynamic 1-bit خفّض حجمه من ٤.٩ تيرابايت إلى ٣٩٧ غيغابايت، ما يتيح تشغيله محليًا عبر Unsloth Desktop على أجهزة بذاكرة تتجاوز ٤١٠ غيغابايت.
الحقائق الأساسية
يوفر vLLM دعمًا للنموذج منذ يوم الإطلاق، مع نقاط تفتيش جاهزة بدقة ٤ بت لكل من NVIDIA وAMD.
«Day-0 support in vLLM, verified on @NVIDIA and @AMD hardware. A ready-made 4-bit checkpoint per vendor, both out of the box:»
عرض المصدر ←تقول UnslothAI إن ضغط النموذج خفّض حجمه بنسبة ٩١٪، من ٤.٩ تيرابايت إلى ٣٩٧ غيغابايت.
«We shrank Qwen3.8-2.4T-A95B from 4.9TB to 397GB (-91% size) via Dynamic 1-bit by selectively quantizing layers»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر