كشفت شركة “إنفيديا” الأمريكية، الرائدة عالميًا في تقنيات الحوسبة والذكاء الاصطناعي، أنها اعتمدت على مجموعة البيانات الصوتية السعودية “صدى” التي أطلقتها الهيئة السعودية للبيانات والذكاء الاصطناعي “سدايا” بالتعاون مع هيئة الإذاعة والتلفزيون، لتدريب نموذجها للتعرّف الآلي على الكلام “Nemotron 3.5 ASR”، ما أسهم في خفض أخطائه في فهم اللهجات السعودية إلى النصف تقريبًا، وذلك في دراسة تقنية نشرتها عبر مدونتها الرسمية للمطورين.
وأوضحت الشركة أن النموذج، الذي يدعم التفريغ النصي اللحظي لنحو 40 لغة ولهجة من بينها العربية، كان يخطئ قبل التدريب في نحو 55 كلمة من كل 100 كلمة من اللهجة السعودية، فيما تراجع معدل الخطأ إلى قرابة 30 كلمة فقط بعد تدريبه على نحو 133.7 ساعة من الكلام باللهجتين النجدية والحجازية من بيانات “صدى”.
ولم يقتصر التحسن على اللهجتين المستهدفتين، إذ انخفض معدل الخطأ على كامل بيانات “صدى” بمختلف لهجاتها من 58.8% إلى 35.6%، وتراجعت نسبة الأخطاء على مستوى الحروف من 31.6% إلى 12.2%، دون أن ينعكس ذلك سلبًا على أداء النموذج في اللغة الإنجليزية أو العربية الفصحى، بل تحسّن أداؤه فيهما أيضًا، في حين لم يستغرق التدريب سوى نحو أربع ساعات ونصف الساعة على وحدتي معالجة رسومية.
وبيّنت “إنفيديا” أن النموذج المطوَّر مهيأ للعمل في التطبيقات التفاعلية الفورية، إذ يمكن تشغيله بزمن استجابة يبدأ من 80 جزءًا من الثانية، ما يجعله مناسبًا لبناء المساعدات الصوتية الذكية ووكلاء المحادثة والترجمة النصية الحية للبث، إلى جانب تفريغ أرشيفات مراكز الاتصال والمحتوى الإعلامي والاجتماعات، كما أتاحت للمطورين الأدوات والخطوات اللازمة لإعادة تنفيذ التجربة وتطبيق المنهجية ذاتها على لغات أخرى.
وكانت الهيئة السعودية للبيانات والذكاء الاصطناعي “سدايا” قد أطلقت مجموعة بيانات “صدى” بالتعاون مع هيئة الإذاعة والتلفزيون عبر منصة “Kaggle” العالمية لعلوم البيانات، لتكون متاحة للباحثين والمطورين حول العالم.
وتضم المجموعة نحو 667 ساعة صوتية مع تفريغها النصي باللغة العربية، تشكّل اللهجات السعودية معظمها، منها أكثر من 600 ساعة وفّرتها هيئة الإذاعة والتلفزيون من أكثر من 57 برنامجًا ومسلسلًا تلفزيونيًا بمختلف اللهجات المحلية، وتولّت “سدايا” تفريغها وتجهيزها للتدريب والمعالجة الآلية، مع تخصيص 20 ساعة للاختبار والتحقق، فيما تغطي البيانات أكثر من عشر لهجات، وتشمل ما يزيد على 125 ألف مقطع صوتي مصنّف وفق لهجة المتحدث، وهو ما مكّن فريق “إنفيديا” من انتقاء المقاطع النجدية والحجازية بدقة لتدريب نموذجه.
وتتيح “صدى” للمجتمعين البحثي والأكاديمي تطوير نماذج ذكاء اصطناعي صوتية متنوعة، مثل التعرّف الآلي على الكلام، ونطق النصوص، وفصل المتحدثين، وتحديد لهجة المتحدث أو جنسه أو عمره، ويأتي نشرها إيمانًا بأهمية إثراء المحتوى العربي، لكون العربية لغة القرآن الكريم ويتحدث بها ملايين الأشخاص حول العالم.
ويعكس اعتماد إحدى كبرى شركات التقنية في العالم على بيانات “صدى” القيمة التي تحملها البيانات الوطنية عالية الجودة في سد الفجوة بين النماذج العالمية واللهجات المحلية، وأثرها المباشر في الارتقاء بجودة تقنيات الذكاء الاصطناعي الموجهة للمستخدم العربي.

مشاركة.
اترك تعليقك

Exit mobile version