Paytmlabs/S2R_Shrutilipi_hindi
Paytmlabs/S2R_Shrutilipi_hindi Hindi speech dataset prepared from ai4bharat/Shrutilipi for Ultravox training. Viewing samples on Hugging Face The hindi config stores audio inside Parquet. The website dataset viewer often cannot decode that and shows no rows. To inspect examples in the browser, open the Subset (config) drop-down and choose hindi_text_samples — text and continuation only (~2000 rows). Ultravox training should keep using subset hindi (full audio).… See the full description on the dataset page: https://huggingface.co/datasets/Paytmlabs/S2R_Shrutilipi_hindi.
Update README: 73/73 train chunks
Add text-only preview for Hub dataset viewer
Update README: 73/73 train chunks
Add validation split
Update README: 73/73 train chunks
Add train chunk 73/73
Add train chunk 72/73
Add train chunk 71/73
Update README: 70/73 train chunks
Add train chunk 70/73
Add train chunk 69/73
Add train chunk 68/73
Add train chunk 67/73
Add train chunk 66/73
Update README: 65/73 train chunks
Add train chunk 65/73
Add train chunk 64/73
Add train chunk 63/73
Add train chunk 62/73
Add train chunk 61/73
Update README: 60/73 train chunks
Add train chunk 60/73
Add train chunk 59/73
Add train chunk 58/73
Add train chunk 57/73
Add train chunk 56/73
Update README: 55/73 train chunks
Add train chunk 55/73
Add train chunk 54/73
Add train chunk 53/73
Add train chunk 52/73
Add train chunk 51/73
Update README: 50/73 train chunks
Add train chunk 50/73
Add train chunk 49/73
Add train chunk 48/73
Add train chunk 48/73
Add train chunk 47/73
Add train chunk 46/73
Update README: 45/73 train chunks
Add train chunk 45/73
Add train chunk 44/73
Add train chunk 43/73
Add train chunk 42/73
Add train chunk 41/73
Update README: 40/73 train chunks
Add train chunk 40/73
Add train chunk 39/73
Add train chunk 38/73
Add train chunk 37/73
