
لعمل صوت كويتي خاص بك تحتاج أولًا إلى تجهيز بيانات صوتية. لا يكفي تسجيل جملة واحدة أو حروف فقط؛ لأن النظام يحتاج أن يتعلم طريقة نطق الشخص للكلمات المختلفة.
الطريقة الصحيحة تكون كالتالي:
1) اختر المتحدث
- شخص واحد فقط للصوت الأول.
- صوت واضح (بدون صدى أو ضوضاء).
- ميكروفون جيد قدر الإمكان.
- نفس طريقة التسجيل طوال الوقت.
2) لا تتكلم كلامًا عشوائيًا
الأفضل أن تقرأ نصوصًا مكتوبة مسبقًا.
مثال:
السلام عليكم، اليوم راح نتكلم عن الطقس في الكويت.
شلونكم، إن شاء الله أموركم طيبة.
أنا أحب القهوة العربية وأحب أزور الأماكن القديمة.
الكويت دولة جميلة فيها البحر والأسواق والتراث.السبب: البرنامج يحتاج أن يعرف العلاقة بين النص المكتوب والصوت المنطوق.
3) ماذا تسجل؟
للتجربة الأولى:
- 30 دقيقة إلى ساعة صوت نظيف: تجربة بسيطة.
- 3 إلى 5 ساعات: نتيجة أفضل.
- 10 ساعات أو أكثر: جودة أعلى.
كلما زادت البيانات، تحسن الصوت.
4) مواصفات التسجيل
يفضل:
- WAV وليس MP3.
- 22050Hz أو 24000Hz.
- Mono (قناة واحدة).
- بدون موسيقى أو ضوضاء.
مثال اسم الملفات:
voice/
│
├── 001.wav
├── 002.wav
├── 003.wavومع كل ملف نصه:
001.txt
السلام عليكم ورحمة الله وبركاته
002.txt
شلونكم اليوميعني:
001.wav
001.txt
002.wav
002.txt5) ماذا تقرأ بالضبط؟
لا تحتاج قراءة الحروف منفصلة مثل:
أ ب ت ث ج ح خهذا ليس الأفضل.
الأفضل جمل تحتوي على كل الأصوات:
مثلاً:
هايف راح للبيت بعد الدوام.فيها أصوات كثيرة.
اجعل النصوص متنوعة:
- أرقام.
- أسماء.
- أسئلة.
- جمل يومية.
- كلمات كويتية.
6) بعد التسجيل
تكون النتيجة:
kuwaiti_voice_dataset/
├── wavs/
│ ├── 001.wav
│ ├── 002.wav
│
└── transcripts/
├── 001.txt
├── 002.txtهذا هو الشيء الذي ترفعه لمشروعك لاحقًا للتدريب.
نصيحتي لأول تجربة: لا تبدأ بـ 10 ساعات. اعمل ساعة واحدة بصوت كويتي واضح، جهز الملفات بالطريقة السابقة، وجرب التدريب أو التجهيز. إذا كانت النتيجة جيدة، زد التسجيلات
ملف صوت WAV حجمه 15 MB استخدامه كبداية لمشروع صوت كويتي، فاعمل الخطوات التالية:
1) لا تضع الملف مباشرة كـ "صوت نهائي"
ملف WAV واحد لا يكفي لتحويل أي نص جديد إلى كلام. هو فقط تسجيل صوتي
2) تأكد من معلومات الملف
يفضل أن يكون:
- WAV
- Mono (قناة واحدة)
- 22050Hz أو 24000Hz أو 16000Hz
- PCM وليس مضغوطًا
يمكنك معرفة ذلك باستخدام برنامج مجاني مثل:
Audacity
افتح الملف ثم:
- File → Export
- اختر WAV
- اختر PCM 16-bit
3) إذا تريد تحويله إلى نموذج صوت
تحتاج تجهيز بيانات، وليس ملفًا واحدًا.
يعني بدل:
voice.wavيكون:
dataset/
├── 001.wav
├── 001.txt
├── 002.wav
├── 002.txt
├── 003.wav
├── 003.txtكل ملف صوت له النص الذي قيل فيه.
4) ماذا تفعل الآن لمشروعك؟
بما أنك تريد مشروعًا خفيفًا، الخطوة القادمة:
- ضع ملف WAV في مجلد
voice. - أكمل واجهة HTML وFastAPI.
- نجعل البرنامج في البداية يشغل هذا الصوت للتجربة.
- بعد ذلك نقرر هل نحتاج تدريب نموذج أو إضافة محرك TTS.
سؤالي المهم الآن:
هل ملف الـ WAV الذي حجمه 15 MB هو:
- تسجيل شخص كويتي يقرأ جملًا؟
أم - ملف صوت جاهز تريد أن تجعل البرنامج يتكلم بنفس الصوت؟
لأن طريقة التعامل تختلف تمامًا.
***************




ليست هناك تعليقات: