مطور يطلق أداة لتشغيل نموذج Qwen3.8-Flash-Next على أجهزة ماك
تتيح أداة slotstream تشغيل نموذج Qwen3.8-Flash-Next الضخم على أجهزة ماك، عبر بث أوزانه من القرص الصلب بدل تحميلها كاملةً في الذاكرة. النموذج يضم ١٢٥ مليار معامل ويشغل ١٠٤ غيغابايت تقريبًا بصيغة ٤ بت، بينما تعمل الأداة كملف Swift واحد وتدعم واجهتي Ollama وOpenAI. تحتاج إلى Apple Silicon وmacOS 14 أو أحدث ونحو ١١٠ غيغابايت مساحة حرة، أما تنزيل الأوزان فيبلغ ١٠٣٫٨ غيغابايت ويستغرق قرابة ساعتين و٢٠ دقيقة على سرعة ١٠٠ ميغابت في الثانية. تصل سرعة التوليد إلى نحو ١٢ رمزًا في الثانية على جهاز بذاكرة ٤٨ غيغابايت، لكن معالجة مطالبة من ٨ آلاف رمز قد تستغرق دقيقة.
الحقائق الأساسية
تعمل الأداة بملف Swift واحد من دون Python، وتتيح للأدوات الحالية الاتصال بها عبر واجهتي Ollama وOpenAI.
«It's one Swift binary, no Python. It speaks the Ollama and OpenAI chat APIs, so your existing tools work unchanged.»
عرض المصدر ←يتطلب التشغيل أجهزة Apple Silicon ونظام macOS 14 أو أحدث، مع نحو ١١٠ غيغابايت من المساحة الحرة.
«You need Apple Silicon, macOS 14+, and ~110 GB of free disk.»
عرض المصدر ←بلغ زمن التثبيت الفعلي ٣٥ دقيقة، لكن سرعة النقل من Hugging Face قد تجعل التنزيل يستغرق نحو ساعتين و٢٠ دقيقة عند اتصال بسرعة ١٠٠ ميغابت في الثانية.
«A real install took 35 minutes. Hugging Face caps the transfer at roughly 36–57 MB/s however many connections you open, so past ~400 Mbps the wait is Hugging Face's day, not your link. At 100 Mbps plan on ~2 h 20; at 25 Mbps, ~9 h.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر