CoolFace
Datasetpublic

AdityK2409/common_voice_17_indic_te

Ekacare/Common Voice 17 Indic Te Dataset Description This dataset contains 62 samples organized across multiple splits. The dataset includes audio data. Splits train: 62 samples Dataset Creation This dataset was created using StreamableDatasetManager on 2025-10-10T19:51:47.900631. Data Fields The dataset includes the following columns: client_id: String data audio: Audio data (16kHz sampling rate) md5_audio: String… See the full description on the dataset page: https://huggingface.co/datasets/AdityK2409/common_voice_17_indic_te.

sourceHugging Facemitupdated 11mo agoView on Hugging Face
0likes21downloads
Dataset Card

Ekacare/Common Voice 17 Indic Te

Dataset Description

This dataset contains 62 samples organized across multiple splits. The dataset includes audio data.

Splits

  • train: 62 samples

Dataset Creation

This dataset was created using StreamableDatasetManager on 2025-10-10T19:51:47.900631.

Data Fields

The dataset includes the following columns:

  • client_id: String data
  • audio: Audio data (16kHz sampling rate)
  • md5_audio: String data
  • duration: Float32 data
  • sentence_id: String data
  • sentence: String data
  • up_votes: Int64 data
  • down_votes: Int64 data
  • age: String data
  • gender: String data
  • variant: String data
  • locale: String data
  • segment: String data
  • accents: String data

Technical Details

  • Total samples: 62
  • Shard length: 10
  • Number of splits: 1
  • Audio format: 16kHz sampling rate