datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
mls10k_wavtokenizermusicbench-wavtokenizergigaspeech_xl_wavtokenizerlttsr_wavtokenizerltts_wavtokenizerasante-twi-wavtokenizer-aligned-newmusicbench-wavtokenizer-smallTTS-German-wavtokenizer-50002akan-tts-wavtokenizer-combined
Akan TTS — WavTokenizer Word-Aligned Combined Dataset
Combined word-aligned dataset for training Akan/Twi TTS models. Audio encoded with WavTokenizer (75Hz, single codebook, codes 0-4095) and word boundaries from MMS forced alignment.
Overview
Total samples
96,615
Total hours
222.9h
Sources
5
Splits
Split
Samples
Hours
train
95,165
219.4h
validation
966
2.2h
test
484
1.2h
Sources
Source
Samples
Hours… See the full description on the dataset page: https://huggingface.co/datasets/ik/akan-tts-wavtokenizer-combined.llm_nemo_wavtokenizer_longakan-tts-wavtokenizer-combined-v2tedlium_wavtokenizerljspeech_wavtokenizerasante-twi-wavtokenizer-alignedexpresso_wavtokenizerwavtokenizer-librispeechljspeech_wavtokenizermls_eng_10k_wavtokenizer_250k
