ai-ssam/darija-tts-8400
Darija TTS 8400 Synthetic Moroccan Darija speech for TTS fine-tuning: 8,400 single-speaker clips (20.73 hours), 24 kHz mono PCM16 WAV. All audio is generated with Gemini 3.1 Flash TTS (gemini-3.1-flash-tts-preview, voice Kore). Clips are unreviewed; there are no human recordings. Write-up of how this data was used: Training a Voice. At a glance Clips / hours 8,400 / 20.73 Unique texts 4,800 Voice Kore (1 speaker) Sample rate 24 kHz mono PCM16… See the full description on the dataset page: https://huggingface.co/datasets/ai-ssam/darija-tts-8400.
Expand dataset card with composition and generation notes
Shorten dataset card; link to project post
Point DODa provenance to GitHub; drop private training-data link
Update dataset card
Upload train_darija_omnivoice.py
Upload train_darija_moss_local_v1_5.py
Add Darija TTS 8400 dataset (part 14)
Add Darija TTS 8400 dataset (part 13)
Add Darija TTS 8400 dataset (part 12)
Add Darija TTS 8400 dataset (part 11)
Add Darija TTS 8400 dataset (part 10)
Add Darija TTS 8400 dataset (part 9)
Add Darija TTS 8400 dataset (part 8)
Add Darija TTS 8400 dataset (part 7)
Add Darija TTS 8400 dataset (part 6)
Add Darija TTS 8400 dataset (part 5)
Add Darija TTS 8400 dataset (part 4)
Add Darija TTS 8400 dataset (part 3)
Add Darija TTS 8400 dataset (part 2)
Add Darija TTS 8400 dataset
initial commit
