إطلاق محرك TurboFieldfare لتشغيل نموذج Gemma 4 على أجهزة ماك

أطلق مطور محرك «تيربو فيلدفير» لتشغيل نموذج «جيما 4» الذي يضم 26 مليار معامل على أجهزة ماك بمعالجات آبل السيليكون — حتى تلك التي لا تملك سوى 8 غيغابايت من الذاكرة. الحيلة تكمن في إبقاء النواة المشتركة وذاكرة التخزين المؤقت فقط في الذاكرة بحجم نحو 2 غيغابايت، ثم بث الخبراء المطلوبة لكل رمز مباشرة من القرص الصلب، بدلًا من تحميل النموذج كاملًا البالغ حجمه 14.3 غيغابايت. المحرك مكتوب بلغة Swift وأداة Metal وهو مخصص للنموذج ذاته وليس غلافًا على MLX أو llama.cpp، ويوفّر واجهة ماك أصلية وأداة سطر أوامر وخادمًا متوافقًا مع OpenAI. جرى التحقق من الأداء على جهاز ماك بوك إير M2 بذاكرة 8 غيغابايت، ويشمل سجل التجارب المنظّم 103 نتائج مقاسة عبر النوى والتخزين المؤقت والإدخال والإخراج.
الحقائق الأساسية
يشغّل المحرك نموذج جيما 4 المكون من 26 مليار معامل باستخدام نحو 2 غيغابايت فقط من الذاكرة العشوائية
«Gemma 4 26B-A4B inference in about 2 GB of RAM»
عرض المصدر ←بدلًا من تحميل النموذج كاملًا بحجم 14.3 غيغابايت، يُبقي المحرك النواة المشتركة بحجم 1.35 غيغابايت في الذاكرة ويبث الخبراء المطلوبة لكل رمز من القرص الصلب
«It keeps the shared 1.35 GB core and FP16 KV cache in memory, then streams only the experts needed for each token from SSD.»
عرض المصدر ←الجهاز المُتحقق منه هو ماك بوك إير M2 بذاكرة 8 غيغابايت، ويتطلب النظام macOS 26 وMetal 4
«the validated target is an 8 GB M2 MacBook Air»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر