CoolFace
Datasetpublic

shraavb/spanish-slang-stt-data

Spanish Regional Speech-to-Text Dataset A multilingual Spanish speech recognition dataset covering 4 regional dialects for fine-tuning Whisper and other ASR models. Dataset Description This dataset contains ~39,000 audio samples with transcriptions across 4 Spanish-speaking regions: Region Samples Description Mexico 17,725 Mexican Spanish including CIEMPIESS corpus Spain 11,360 Castilian Spanish from TEDx and Common Voice Argentina 5,839 Rioplatense… See the full description on the dataset page: https://huggingface.co/datasets/shraavb/spanish-slang-stt-data.

sourceHugging Facecc-by-4.0updated 9mo agoView on Hugging Face
0likes1.5kdownloads

shraavb/spanish-slang-stt-data · main · files are served by the source, never re-hosted here

shraavb/spanish-slang-stt-data · CoolFace