الذكاء الاصطناعي٢٣ سبتمبر ٢٠٢٦
فريق vLLM يطلق الإصدار 0.30.0 مع دعم نماذج جديدة
أطلق مشروع vLLM الإصدار 0.30.0، مع تحسينات لمسارات الانتباه الهجينة ودعم مكوّنات في نماذج Kimi K3 وDeepSeek-V4.1-Flash وQwen3.8-Flash-Next، بحسب منشور الحساب على إكس. ويشمل الإصدار تحسينات لـKDA وAttnRes وMLA، وإضافة MXFP8 KV وAsync Engram، ودمج QSA وPLE لتقليل عبء sparse-GQA. وجاء الإصدار بعد ٧٦٢ مساهمة برمجية شارك فيها ٣١٥ مساهماً، بينهم ١٠٤ يشاركون للمرة الأولى.
الحقائق الأساسية
الإصدار يقدّم تحسينات مرتبطة بثلاثة نماذج: Kimi K3 وDeepSeek-V4.1-Flash وQwen3.8-Flash-Next.
«🤖 Hybrid-attention hot paths: Kimi K3 streamlines KDA, AttnRes, and MLA; DeepSeek-V4.1-Flash adds MXFP8 KV and async Engram; Qwen3.8-Flash-Next fuses QSA/PLE and cuts sparse-GQA overhead»
عرض المصدر ←شارك في تطوير الإصدار ٣١٥ مساهماً، منهم ١٠٤ يساهمون للمرة الأولى.
«762 commits. 315 contributors. 104 first-timers. vLLM v0.30.0 is live. 🎉»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر