← كل الأخبار
الذكاء الاصطناعي٢٦ أغسطس ٢٠٢٦

علي بابا تطلق نموذج Qwen3.8-Flash مفتوح الأوزان

شارك
علي بابا تطلق نموذج Qwen3.8-Flash مفتوح الأوزان

حصل نموذج Qwen3.8-Flash-Next من Alibaba على دعم فوري في vLLM، مع التحقق من تشغيله على معالجات الرسوميات من NVIDIA وAMD. ويعتمد النموذج على بنية متعددة الوسائط شديدة الترشيد، بإجمالي ١٢٥ مليار معامل يُفعَّل منها ٦ مليارات، وسياق أصلي بطول ٢٦٢ ألف رمز يمكن تمديده إلى مليون عبر YaRN، إضافة إلى جدول N-gram مستقل بسعة ٥١ مليار معامل. كما أصبح جاهزًا للنشر عبر SGLang، لكن المصادر لا تذكر إطلاقًا مفتوح الأوزان.

الحقائق الأساسية

  • يعمل النموذج على عتاد NVIDIA وAMD منذ اليوم الأول ضمن vLLM.

    «Qwen3.8-Flash-Next from @Alibaba_Qwen has day-0 support in vLLM, verified on NVIDIA and AMD GPUs. 🎉»
    عرض المصدر ←
  • يضم النموذج ١٢٥ مليار معامل، مع تفعيل ٦ مليارات، ويدعم سياقًا أصليًا من ٢٦٢ ألف رمز يصل إلى مليون عبر YaRN.

    «Ultra-sparse multimodal MoE: 125B params, 6B active, 262K native, 1M via YaRN.»
    عرض المصدر ←
  • أصبح النموذج جاهزًا للنشر عبر SGLang.

    «Qwen3.8-Flash-Next is ready to deploy with SGLang today.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر