ragunath-ravi/TamilVoiceCorpus
Tamil Conversational ASR Dataset This is a dataset for Automatic Speech Recognition (ASR) focused on conversational Tamil, collected from various public sources on the web. Each sample is a short audio clip (averaging 10 seconds) paired with its corresponding transcription. Dataset Summary Language: Tamil (ta) Domain: Conversational speech Average Duration per Clip: ~10 seconds Format: Audio (.wav) + text Sample Rate: 16kHz recommended Total Examples: PureVox:… See the full description on the dataset page: https://huggingface.co/datasets/ragunath-ravi/TamilVoiceCorpus.
Conversations for this repository live on Hugging Face.
CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.
Open discussions on Hugging Face