← كل الأخبار
الذكاء الاصطناعي٣ أكتوبر ٢٠٢٦

إنفيديا تطور تقنيات التعرف على اللهجات السعودية باستخدام بيانات «صدى»

شارك
إنفيديا تطور تقنيات التعرف على اللهجات السعودية باستخدام بيانات «صدى»

طوّرت NVIDIA نموذج Nemotron 3.5 ASR للتعرّف الآلي على الكلام، باستخدام بيانات «صدى» السعودية لتحسين فهم اللهجتين النجدية والحجازية. شملت التجربة ١٣٣.٧ ساعة من الكلام، وخفّضت معدل أخطاء الكلمات في اختبار اللهجتين من ٥٥.٠٥٪ إلى ٢٩.٩٦٪. ويدعم النموذج نحو ٤٠ لغة ولهجة، بينما تقول نتائج NVIDIA إن تخصيصه للهجات السعودية لم يضعف أداءه المختبر في العربية والإنجليزية.

الحقائق الأساسية

  • احتفظ الفريق بـ١٠٣٬٥٥٩ مقطعًا صوتيًا من أصل ١٢٥٬٤٩٠ مقطعًا بعد تنقية البيانات.

    «وبعد عملية التنقية، احتفظ الفريق بـ 103,559 مقطعًا صوتيًا من أصل 125,490 مقطعًا، بإجمالي 133.7 ساعة من الكلام، أي ما يعادل نحو 82.5% من البيانات التي بدأت بها التجربة.»
    عرض المصدر ←
  • انخفض معدل أخطاء الكلمات في مجموعة «صدى» الكاملة من ٥٨.٨٤٪ إلى ٣٥.٦١٪.

    «فعند اختبار النموذج على مجموعة «صدى» كاملة، انخفض معدل خطأ الكلمات من 58.84% إلى 35.61%، بينما تراجع معدل خطأ الحروف من 35.40% إلى 15.97%.»
    عرض المصدر ←
  • استغرقت عملية التدريب الأساسية نحو ٤.٥ ساعات باستخدام وحدتي معالجة رسومية.

    «استغرقت تجربة التدريب الأساسية نحو 4.5 ساعات على وحدتي معالجة رسومية من طراز NVIDIA RTX PRO 6000 Blackwell Workstation Edition، وذلك خلال تشغيل استمر لنحو 12 ألف خطوة تدريبية.»
    عرض المصدر ←

المصادر

شفت معلومة تحتاج تصحيح؟ بلّغنا ونتحقق ونصحّح — سياسة التصحيح

صحّح هذا الخبر