← كل الأخبار
الذكاء الاصطناعي٢٣ سبتمبر ٢٠٢٦

فريق vLLM يطلق الإصدار 0.30.0 مع دعم نماذج جديدة

شارك

أطلق مشروع vLLM الإصدار 0.30.0، مع تحسينات لمسارات الانتباه الهجينة ودعم مكوّنات في نماذج Kimi K3 وDeepSeek-V4.1-Flash وQwen3.8-Flash-Next، بحسب منشور الحساب على إكس. ويشمل الإصدار تحسينات لـKDA وAttnRes وMLA، وإضافة MXFP8 KV وAsync Engram، ودمج QSA وPLE لتقليل عبء sparse-GQA. وجاء الإصدار بعد ٧٦٢ مساهمة برمجية شارك فيها ٣١٥ مساهماً، بينهم ١٠٤ يشاركون للمرة الأولى.

الحقائق الأساسية

  • الإصدار يقدّم تحسينات مرتبطة بثلاثة نماذج: Kimi K3 وDeepSeek-V4.1-Flash وQwen3.8-Flash-Next.

    «🤖 Hybrid-attention hot paths: Kimi K3 streamlines KDA, AttnRes, and MLA; DeepSeek-V4.1-Flash adds MXFP8 KV and async Engram; Qwen3.8-Flash-Next fuses QSA/PLE and cuts sparse-GQA overhead»
    عرض المصدر ←
  • شارك في تطوير الإصدار ٣١٥ مساهماً، منهم ١٠٤ يساهمون للمرة الأولى.

    «762 commits. 315 contributors. 104 first-timers. vLLM v0.30.0 is live. 🎉»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر