الذكاء الاصطناعي٢٣ يوليو ٢٠٢٦
علي بابا تطلق نموذج تحويل النص إلى كلام Qwen-Audio-3.0-TTS

أطلق فريق علي بابا نموذجه الجديد لتحويل النص إلى كلام تحت اسم Qwen-Audio-3.0-TTS، وبنسختين مختلفتين لتلبية احتياجات متباينة. النسخة الأولى مخصصة للتفاعل اللحظي، بينما تركّز الثانية على توليد صوتي عالي الجودة. أبرز ما يميز الإصدار الجديد هو دعم وسوم تحكم دقيقة تُدرج داخل النص لتوجيه نبرة الصوت كالهمس والضحك، إضافة إلى مرونة استخدام أوامر اللغة الطبيعية بحرية.
الحقائق الأساسية
يأتي نموذج Qwen-Audio-3.0-TTS في نسختين: الأولى للتفاعل اللحظي والثانية للتوليد عالي الجودة
«Our latest text-to-speech model, in two flavors: • Flash: real-time interaction • Plus: high-quality generation»
عرض المصدر ←يدعم النموذج وسوماً مدمجة للتحكم الدقيق في نبرة الصوت كالهمس والغضب والضحك
«Fine-grained inline tags-steer [whisper], [angry], [breaths] & [laughs]»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر