توسيم بيانات ASR: النسخ والتفريغ الصوتي
كيف نوسم الصوت العربي المنطوق ليتمكن النموذج من فهمه فعليًا.
مهام التعرف الآلي على الكلام (ASR) تتطلب دقة مضاعفة لأن الصوت لا يُكتب دائمًا كما يُنطق.
ما تعمل عليه هنا
- النسخ الصوتي (Transcription): كتابة ما يُقال بالضبط، شاملًا الكلمات الدخيلة والتردد.
- التسمية الصوتية (Phonetic Labeling): تمييز خصائص النطق الخاصة باللهجة.
- فصل المتحدثين (Speaker Diarization): تحديد من يتحدث ومتى في تسجيل متعدد المتحدثين.
- التحقق من جودة الصوت: رفض التسجيلات ذات الضجيج العالي أو غير المفهومة.
اكتب دائمًا بلهجة المتحدث الفعلية، لا بالفصحى، إلا إذا نص دليل المشروع على غير ذلك.