إنفيديا تستعين باللهجات السعودية في مشروعها للتعرف على الكلام

اعتمدت إنفيديا على بيانات «صدى» السعودية لتدريب نموذجها «Nemotron 3.5 ASR» على اللهجتين النجدية والحجازية، ما خفّض أخطاء التعرّف على الكلام السعودي إلى النصف تقريبًا. شملت التجربة نحو 133.7 ساعة من التسجيلات، فتراجع الخطأ من نحو 55 كلمة من كل 100 إلى قرابة 30 كلمة. وعلى كامل بيانات «صدى»، انخفض معدل الخطأ من 58.8% إلى 35.6%، بينما هبطت أخطاء الحروف من 31.6% إلى 12.2%، من دون تراجع في الإنجليزية أو العربية الفصحى. وتقول الشركة إن النموذج مناسب للمساعدات الصوتية والترجمة النصية الحية وتفريغ الاجتماعات ومراكز الاتصال، مع زمن استجابة يبدأ من 80 جزءًا من الثانية، وقد أتاحت للمطورين خطوات إعادة التجربة.
الحقائق الأساسية
استغرق تدريب النموذج نحو أربع ساعات ونصف الساعة باستخدام وحدتي معالجة رسومية.
«في حين لم يستغرق التدريب سوى نحو أربع ساعات ونصف الساعة على وحدتي معالجة رسومية.»
عرض المصدر ←تضم «صدى» نحو 667 ساعة صوتية مفرّغة بالعربية، وأكثر من 125 ألف مقطع يغطي أكثر من عشر لهجات.
«وتضم المجموعة نحو 667 ساعة صوتية مع تفريغها النصي باللغة العربية، تشكّل اللهجات السعودية معظمها، منها أكثر من 600 ساعة وفّرتها هيئة الإذاعة والتلفزيون من أكثر من 57 برنامجًا ومسلسلًا تلفزيونيًا بمختلف اللهجات المحلية، وتولّت "سدايا" تفريغها وتجهيزها للتدريب والمعالجة الآلية، مع تخصيص 20 ساعة للاختبار والتحقق، فيما تغطي البيانات أكثر من عشر لهجات، وتشمل ما يزيد على 125 ألف مقطع صوتي مصنّف وفق لهجة المتحدث، وهو ما مكّن فريق "إنفيديا" من انتقاء المقاطع النجدية والحجازية بدقة لتدريب نموذجه.»
عرض المصدر ←
المصادر
شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح
صحّح هذا الخبر