الرئيسية/البيانات/الصوت واللهجات

بيانات الصوت واللهجات

تسجيلات لهجات، محادثات طبيعية، أزواج تحويل كلام-نص، وتبديل شيفرة لغوية — مسجّلة من متحدثين باللهجة التي يحتاج النموذج فهمها أو إنتاجها فعليًا.

اللهجة هي المتغيّر الأهم هنا، وهي أيضًا ما تتعامل معه منصات العمل الجماعي العامة بأسوأ شكل: نص مقروء من متحدث مصري وآخر من متحدث خليجي ليسا بيانات متبادلة، رغم أن كليهما "عربي". نجنّد حسب المنطقة اللهجية لا اللغة فقط، ونتحقق من طبيعية الأداء — النصوص المقروءة تختلف صوتيًا عن الكلام العفوي، والنموذج المدرَّب على أحدهما يضعف أداؤه على الآخر.

ما الذي يتحقق منه المراجع

جودة الصوت (الضوضاء الخلفية، التشويش، مسافة الميكروفون)، دقة النسخ الكتابي مقارنة بالتسجيل الفعلي، والتحقق الذي يسهل تجاهله رغم أهميته: هل الكلام يمثّل فعلاً الاستخدام الطبيعي للهجة، لا نصًا مقروءًا بمستوى لغوي غير طبيعي.

مثال تطبيقي. احتاج فريق ذكاء اصطناعي صوتي بيانات محادثة خليجية طبيعية مع تبديل شيفرة لغوية إلى الإنجليزية لمصطلحات خدمة العملاء. جنّدنا مساهمين خليجيين ثنائيي اللغة وجمعنا أزواج محادثة غير مكتوبة مسبقًا بدل قراءة نصوص جاهزة، وهو ما تتطلبه بيانات تبديل الشيفرة اللغوية لتكون صالحة للاستخدام فعليًا.