AdityK2409/common_voice_17_indic_te
Ekacare/Common Voice 17 Indic Te Dataset Description This dataset contains 62 samples organized across multiple splits. The dataset includes audio data. Splits train: 62 samples Dataset Creation This dataset was created using StreamableDatasetManager on 2025-10-10T19:51:47.900631. Data Fields The dataset includes the following columns: client_id: String data audio: Audio data (16kHz sampling rate) md5_audio: String… See the full description on the dataset page: https://huggingface.co/datasets/AdityK2409/common_voice_17_indic_te.
Ekacare/Common Voice 17 Indic Te
Dataset Description
This dataset contains 62 samples organized across multiple splits. The dataset includes audio data.
Splits
- train: 62 samples
Dataset Creation
This dataset was created using StreamableDatasetManager on 2025-10-10T19:51:47.900631.
Data Fields
The dataset includes the following columns:
- client_id: String data
- audio: Audio data (16kHz sampling rate)
- md5_audio: String data
- duration: Float32 data
- sentence_id: String data
- sentence: String data
- up_votes: Int64 data
- down_votes: Int64 data
- age: String data
- gender: String data
- variant: String data
- locale: String data
- segment: String data
- accents: String data
Technical Details
- Total samples: 62
- Shard length: 10
- Number of splits: 1
- Audio format: 16kHz sampling rate
