kapilkarda/indic-multilingual-tts-v2
Indic Multilingual TTS v2 Combined dataset for training multilingual Indian-language TTS models, specifically prepared for Spark-TTS BiCodec and LLM fine-tuning. Dataset Summary Metric Value Total samples 556,524 (550K train + 6.5K val) Total duration ~1,251 hours (1,237h train + 14h val) Languages 13 (12 Indic + Indian English) Sources IndicVoices-R, Rasa, IndicTTS Audio format WAV, 16kHz mono Emotion labels 6 emotions + neutral + domain tags… See the full description on the dataset page: https://huggingface.co/datasets/kapilkarda/indic-multilingual-tts-v2.
156
No card is published for this repository, or it could not be fetched from Hugging Face right now.
