← كل الأخبار
الذكاء الاصطناعي٣ أكتوبر ٢٠٢٦

برايم إنتلكت تطلق خدمة الاستدلال Prime Inference بنموذج GLM-5.3

شارك
برايم إنتلكت تطلق خدمة الاستدلال Prime Inference بنموذج GLM-5.3

أطلقت برايم إنتلكت خدمة الاستدلال Prime Inference لتشغيل نموذج GLM-5.3 على نطاق واسع. وتستخدم الخدمة vLLM، بينما يذكر أحد المنشورين أيضًا NVIDIA Dynamo ضمن مكوّناتها. وتركّز برايم إنتلكت على بنية التشغيل بين التمهيد والتوليد، وتقليل فجوات جدولة المهام، وتحسين موثوقية استدعاء الأدوات في أعباء عمل الوكلاء.

الحقائق الأساسية

  • تُشغّل Prime Inference نموذج GLM-5.3 عبر vLLM، ويشير أحد المصدرين إلى استخدام NVIDIA Dynamo أيضًا.

    «Great work from the Prime Intellect team launching Prime Inference with GLM-5.3 served by vLLM and NVIDIA Dynamo!»
    عرض المصدر ←
  • يتناول العمل بنية التمهيد والتوليد، وفجوات الجدولة، وموثوقية استدعاء الأدوات.

    «Their work covers prefill/decode topology, scheduler bubbles, and reliable tool calls.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر