CoolFace
Datasetpublic

shraavb/spanish-slang-stt-data

Spanish Regional Speech-to-Text Dataset A multilingual Spanish speech recognition dataset covering 4 regional dialects for fine-tuning Whisper and other ASR models. Dataset Description This dataset contains ~39,000 audio samples with transcriptions across 4 Spanish-speaking regions: Region Samples Description Mexico 17,725 Mexican Spanish including CIEMPIESS corpus Spain 11,360 Castilian Spanish from TEDx and Common Voice Argentina 5,839 Rioplatense… See the full description on the dataset page: https://huggingface.co/datasets/shraavb/spanish-slang-stt-data.

sourceHugging Facecc-by-4.0updated 9mo agoView on Hugging Face
0likes1.5kdownloads
settings

This repository belongs to shraavb on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namespanish-slang-stt-data
visibilitypublic
licencecc-by-4.0
gatedno
ownershraavb
Account settings
shraavb/spanish-slang-stt-data · CoolFace