kapilkarda/indic-multilingual-tts-v2
Indic Multilingual TTS v2 Combined dataset for training multilingual Indian-language TTS models, specifically prepared for Spark-TTS BiCodec and LLM fine-tuning. Dataset Summary Metric Value Total samples 556,524 (550K train + 6.5K val) Total duration ~1,251 hours (1,237h train + 14h val) Languages 13 (12 Indic + Indian English) Sources IndicVoices-R, Rasa, IndicTTS Audio format WAV, 16kHz mono Emotion labels 6 emotions + neutral + domain tags… See the full description on the dataset page: https://huggingface.co/datasets/kapilkarda/indic-multilingual-tts-v2.
Conversations for this repository live on Hugging Face.
CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.
Open discussions on Hugging Face