أخيرة

الاستعانة باللهجات السعودية للتعرف على الكلام بالذكاء الاصطناعي

133.7 ساعة تدريب باللَّهجتين النجديَّة والحجازيَّة

المدينة-الرياض 03 أكتوبر 2026 22:24 دقيقة قراءة
كشفت شركة «إنفيديا» الأمريكيَّة، عن اعتمادها على مجموعة البيانات الصوتيَّة السعوديَّة «صدى» التي أطلقتها الهيئة السعوديَّة للبيانات والذكاء الاصطناعي «سدايا» بالتَّعاون مع هيئة الإذاعة والتلفزيون؛ لتدريب نموذجها للتعرُّف الآلي على الكلام «Nemotron 3.5 ASR»؛ ما أسهم في خفض أخطائه في فهم اللَّهجات السعوديَّة إلى النصف تقريبًا، وذلك في دراسة تقنيَّة نشرتها عبر مدوَّنتها الرسميَّة للمطوِّرين.
وأوضحت «إنفيديا» أنَّ النموذج، الذي يدعم التفريغ النصي اللَّحظي لنحو 40 لغة ولهجة من بينها العربيَّة، كان يخطئ قبل التدريب في نحو 55 كلمةً من كل 100 كلمة من اللهجة السعوديَّة، فيما تراجع معدل الخطأ إلى قرابة 30 كلمة فقط، بعد تدريبه على نحو 133.7 ساعة من الكلام باللَّهجتين النجديَّة والحجازيَّة من بيانات «صدى».
وبيَّنت أنَّ النموذج المطوَّر مهيَّأ للعمل في التطبيقات التفاعليَّة الفوريَّة، إذ يمكن تشغيله بزمن استجابة يبدأ من 80 جزءًا من الثانية، ما يجعله مناسبًا لبناء المساعدات الصوتيَّة الذكيَّة، ووكلاء المحادثة والترجمة النصيَّة الحيَّة للبثِّ.

أخبار ذات صلة