CoolFace
Datasetpublicgated

ragunath-ravi/TamilVoiceCorpus

Tamil Conversational ASR Dataset This is a dataset for Automatic Speech Recognition (ASR) focused on conversational Tamil, collected from various public sources on the web. Each sample is a short audio clip (averaging 10 seconds) paired with its corresponding transcription. Dataset Summary Language: Tamil (ta) Domain: Conversational speech Average Duration per Clip: ~10 seconds Format: Audio (.wav) + text Sample Rate: 16kHz recommended Total Examples: PureVox:… See the full description on the dataset page: https://huggingface.co/datasets/ragunath-ravi/TamilVoiceCorpus.

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
5likes36downloads
discussions and pull requests

Conversations for this repository live on Hugging Face.

CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.

Open discussions on Hugging Face