CoolFace
Datasetpublicgated

kapilkarda/indic-multilingual-tts-v2

Indic Multilingual TTS v2 Combined dataset for training multilingual Indian-language TTS models, specifically prepared for Spark-TTS BiCodec and LLM fine-tuning. Dataset Summary Metric Value Total samples 556,524 (550K train + 6.5K val) Total duration ~1,251 hours (1,237h train + 14h val) Languages 13 (12 Indic + Indian English) Sources IndicVoices-R, Rasa, IndicTTS Audio format WAV, 16kHz mono Emotion labels 6 emotions + neutral + domain tags… See the full description on the dataset page: https://huggingface.co/datasets/kapilkarda/indic-multilingual-tts-v2.

sourceHugging Facecc-by-4.0updated 7mo agoView on Hugging Face
1likes60downloads
discussions and pull requests

Conversations for this repository live on Hugging Face.

CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.

Open discussions on Hugging Face
kapilkarda/indic-multilingual-tts-v2 · CoolFace