← كل الأخبار
الذكاء الاصطناعي٢٠ أغسطس ٢٠٢٦

إطلاق نموذج Muse Spark 1.2 متعدد الوسائط

شارك
إطلاق نموذج Muse Spark 1.2 متعدد الوسائط

استعرض حساب @AIatMeta على إكس نموذج Muse Spark 1.2 متعدد الوسائط، مع قدرات تمتد من تحويل الصور إلى شيفرة عاملة إلى ترجمة الإدراك البصري إلى أفعال مادية. ويقول الحساب إن النموذج يفهم الصوت والصورة بكفاءة، بما يلائم مهام الفيديو الشائعة في استخدامات الشركات الواقعية. وأضاف @alexandr_wang أن النموذج يجمع البرمجة البصرية وتخطيط الروبوتات والفهم السمعي البصري عبر أدوات تعمل بالنيابة عن المستخدم.

الحقائق الأساسية

  • يحوّل النموذج المدخلات البصرية إلى شيفرة، ويدعم الانتقال من الإدراك إلى الفعل المادي.

    «Muse Spark 1.2 supports a broad range of multimodal tasks, from turning visuals into working code to translating perception into physical action.»
    عرض المصدر ←
  • تشمل قدراته البرمجة البصرية وتخطيط الروبوتات والفهم السمعي البصري، مع جمعها عبر أدوات تعمل بالنيابة عن المستخدم.

    «1/ muse spark 1.2 is a very strong multimodal model—it can do visual coding, robotics planning, and audio-visual understanding that all come together through agentic tools.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر