← كل الأخبار
الذكاء الاصطناعي١ أكتوبر ٢٠٢٦

مايكروسوفت تطلق نموذج MAI-Transcribe-2 للنسخ الصوتي المباشر

شارك
مايكروسوفت تطلق نموذج MAI-Transcribe-2 للنسخ الصوتي المباشر

أطلقت Microsoft AI نموذج MAI-Transcribe-2-Streaming للنسخ الصوتي إلى نص لحظيًا، بحسب منشور على إكس. وسجّل النموذج دقة بلغت ٢.٥٪ وفق مقياس WER، مع ظهور أول جزء من التفريغ بعد ٠.١٣ ثانية من انتهاء الكلام. ويأتي إلى MAI Playground وواجهات برمجة التطبيقات، إلى جانب نموذجي MAI-Voice-2.1 وMAI-Voice-2.1-Flash.

الحقائق الأساسية

  • حقق النموذج المركز الأول في دقة التفريغ النهائي ودقة أول جزء من التفريغ على مقياس AA-WER Streaming.

    «Microsoft AI has released MAI-Transcribe-2-Streaming, taking the #1 spot for Final Transcript accuracy and First Partial Transcript accuracy on AA-WER Streaming»
    عرض المصدر ←
  • بلغ معدل الخطأ في الكلمات ٢.٥٪، وظهر أول جزء من التفريغ بعد ٠.١٣ ثانية من انتهاء الكلام.

    «with 2.5% WER at 0.13s after end of speech»
    عرض المصدر ←
  • سيُتاح النموذج عبر MAI Playground وواجهات برمجة التطبيقات.

    «MAI-Transcribe-2-Streaming, MAI-Voice-2.1 and MAI-Voice-2.1-Flash models are coming to MAI Playground and APIs!»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر