sulabhkatiyar/ne-asr-dataset-grt
Garo (grt) — ASR dataset A small Garo (grt) speech-to-text dataset for automatic speech recognition (ASR) of a low-resource North-East India language. Each example pairs a short audio clip with its Romanized (Latin-script) transcript. Source Derived from the ARTPARK-IISc Vaani project (https://vaani.iisc.ac.in/) Splits Split Samples train 33,480 validation 4,253 test 4,101 Data fields Each example has: audio — the… See the full description on the dataset page: https://huggingface.co/datasets/sulabhkatiyar/ne-asr-dataset-grt.
docs: rename + Vaani attribution
docs: dataset card
Add dataset card for Garo (grt) ASR dataset
Add test shards 6-9/9 for Garo (grt)
Add test shards 1-5/9 for Garo (grt)
Add validation shards 6-9/9 for Garo (grt)
Add validation shards 1-5/9 for Garo (grt)
Add train shards 66-67/67 for Garo (grt)
Add train shards 61-65/67 for Garo (grt)
Add train shards 56-60/67 for Garo (grt)
Add train shards 51-55/67 for Garo (grt)
Add train shards 46-50/67 for Garo (grt)
Add train shards 41-45/67 for Garo (grt)
Add train shards 36-40/67 for Garo (grt)
Add train shards 31-35/67 for Garo (grt)
Add train shards 26-30/67 for Garo (grt)
Add train shards 21-25/67 for Garo (grt)
Add train shards 16-20/67 for Garo (grt)
Add train shards 11-15/67 for Garo (grt)
Add train shards 6-10/67 for Garo (grt)
Add train shards 1-5/67 for Garo (grt)
initial commit
