CoolFace
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01brunosdorneles /common_voice_ptaudio100K<n<1M0 likes355 downloads2y agoHugging Face02yuriyvnv /synthetic_transcript_pt Portuguese Speech Dataset with Multiple Training Configurations A comprehensive Portuguese speech dataset offering three distinct training configurations for speech recognition research, each designed for different experimental scenarios and training paradigms. 🎯 Dataset Configurations Overview This dataset provides three carefully curated subsets to enable comprehensive speech recognition research: Configuration Training Data Validation Test Total Samples Use Case… See the full description on the dataset page: https://huggingface.co/datasets/yuriyvnv/synthetic_transcript_pt.audioautomatic-speech-recognition100K<n<1M0 likes319 downloads5mo agoHugging Face03murilo-as /librispeech_ptaudion<1K0 likes245 downloads2y agoHugging Face04tech4humans /Audio-Transcription-Models-Comparison-PT-BR Audio Transcription Models Comparison A dataset dedicated to comparing the performance of modern Speech-to-Text (STT) models, focusing exclusively on Brazilian Portuguese. About the Dataset This dataset was created to store and compare transcription results from different Artificial Intelligence models in challenging scenarios. Unlike generic benchmarks, this project focuses on the reality of usage in Brazil, covering: Regionalism: Local vocabulary, accents, and… See the full description on the dataset page: https://huggingface.co/datasets/tech4humans/Audio-Transcription-Models-Comparison-PT-BR.audioautomatic-speech-recognitionn<1K3 likes138 downloads8mo agoHugging Face05marcosremar2 /pt-br-tts-synth pt-br-tts-synth 98813 frases PT-BR sintetizadas com Kokoro-82M (vozes pf_dora/pm_alex/pm_santa, speeds 0.9-1.1x), 16kHz mono WAV em 32 tar shards (WebDataset). Texto gerado por LLM (3 tiers de complexidade x 40 topicos); transcricao, tier, topico, voz e speed em metadata.jsonl. from datasets import load_dataset ds = load_dataset("webdataset", data_files="hf://datasets/marcosremar2/pt-br-tts-synth/shard_*.tar", split="train") audiotext-to-speech10K<n<100K0 likes136 downloads4mo agoHugging Face06aomocelin /commonvoice_13_0_pt_48kHz_simplificado_augmented_white_noise Dataset Card for "commonvoice_13_0_pt_48kHz_simplificado_augmented_white_noise" More Information needed audio10K<n<100K2 likes129 downloads3y agoHugging Face07deepdml /common_voice_17_0_pt_pseudo_labelled-large-v3audio1K<n<10K0 likes119 downloads2y agoHugging Face08RodrigoLimaRFL /named-entities-tts-pt-br-audio-qwen3tts Qwen3-TTS (checkpoint base) — áudio sintetizado de entidades nomeadas Dataset de áudio gerado sinteticamente a partir do glossário de entidades nomeadas do projeto de IC "Aprimoramento de modelos de reconhecimento automático de fala em relação ao reconhecimento de nomes próprios", usando o modelo Qwen3-TTS (Qwen/Qwen3-TTS-12Hz-1.7B-Base) em seu checkpoint base, sem fine-tuning — etapa de baseline do projeto. Splits Split Nº de exemplos train 17309… See the full description on the dataset page: https://huggingface.co/datasets/RodrigoLimaRFL/named-entities-tts-pt-br-audio-qwen3tts.audio10K<n<100K0 likes111 downloads14d agoHugging Face09lgris /common_voice_13_0_pt_pseudo_labelledaudio10K<n<100K1 likes108 downloads3y agoHugging Face10pt-sk /Aria_Dataset-Unsortedaudio0 likes101 downloads2y agoHugging Face11murilo-as /voxforge_ptaudio1K<n<10K0 likes100 downloads2y agoHugging Face12Felipehonorato /pt_it_jamendolyrics Jamendo lyrics subsets (Portuguese and Italian) This repository contains songs and lyrics for Portuguese and italian songs from Jamendo. The repository is still under construction. Data The data is organized following the pattern from Jamendo lyrics community in huggingface. audion<1K0 likes84 downloads9mo agoHugging Face13RodrigoLimaRFL /named-entities-tts-pt-br-audio YourTTS (checkpoint base) — áudio sintetizado de entidades nomeadas Dataset de áudio gerado sinteticamente a partir do glossário de entidades nomeadas do projeto de IC "Aprimoramento de modelos de reconhecimento automático de fala em relação ao reconhecimento de nomes próprios", usando o modelo YourTTS (tts_models/multilingual/multi-dataset/your_tts) em seu checkpoint base, sem fine-tuning — etapa de baseline do projeto. Splits Split Nº de exemplos… See the full description on the dataset page: https://huggingface.co/datasets/RodrigoLimaRFL/named-entities-tts-pt-br-audio.audio10K<n<100K0 likes75 downloads16d agoHugging Face14aomocelin /CV25.0-pt-validated-16kaudio100K<n<1M0 likes73 downloads4mo agoHugging Face15aomocelin /CV25.0-pt-validated-16k-filteredaudio100K<n<1M0 likes72 downloads4mo agoHugging Face16firstpixel /pt-br_chargated Brazilian Portuguese Merged Speech Dataset (Derived from Common Voice) This dataset is a preprocessed and merged version of the Mozilla Common Voice dataset for Brazilian Portuguese (pt-BR). It was created by filtering, merging, and normalizing audio clips to improve usability for speech recognition and TTS (Text-to-Speech) training. 📌 Dataset Details Source: Derived from Common Voice Corpus 20.0 Language: 🇧🇷 Brazilian Portuguese (pt-BR) Format: MP3 (24 kHz, mono… See the full description on the dataset page: https://huggingface.co/datasets/firstpixel/pt-br_char.audiotext-to-speech10K<n<100K7 likes51 downloads2y agoHugging Face17deepdml /mls_pt_pseudo_labelled-large-v3audio10K<n<100K0 likes47 downloads2y agoHugging Face18arda-argmax /common_voice_17_0_pt_pseudo_labelledaudio1K<n<10K1 likes44 downloads1y agoHugging Face19deepdml /fleurs_pt_pseudo_labelled-large-v3audio1K<n<10K0 likes38 downloads2y agoHugging Face20aomocelin /CV25_MLS_pt_16k_max2saudio1K<n<10K0 likes38 downloads3mo agoHugging Face21aomocelin /librispeech_pt_16kaudio10K<n<100K0 likes36 downloads4mo agoHugging Face22aomocelin /commonvoice_13_0_pt_48kHz_simplificado Dataset Card for "commonvoice_13_0_pt_48kHz_simplificado" More Information needed audio10K<n<100K0 likes35 downloads3y agoHugging Face23Jarbas /localingua_pt-brtranscriptions unverified! known to contain mistakes/noise audioautomatic-speech-recognitionn<1K1 likes29 downloads2y agoHugging Face24srxz /vyse-voice-pt-brDataset usado para treinar a voz da Vyse (Valorant) Geração do metadata.csv: Rodar: whisper.sh em seguida transcrib.sh, isso produzira um txt com todas falas pronto para ser utilizado no treinamento com piper audion<1K0 likes29 downloads1y agoHugging Face25aomocelin /CV25.0-pt-validated-16k-filtered-max5saudio100K<n<1M0 likes29 downloads4mo agoHugging Face26alissonpadua /tts-dataset-pt-braudiotext-to-speechn<1K0 likes28 downloads4mo agoHugging Face27TigreGotico /locallingua_ptRecordings from Portugal downloaded from https://localingual.com audioautomatic-speech-recognitionn<1K0 likes27 downloads2y agoHugging Face28aomocelin /palavras_pt_BR_ate_4_letrasaudio1K<n<10K0 likes27 downloads3mo agoHugging Face29TigreGotico /compare-accents-ptsmall dataset of multiple portuguese speakers from various dialects speaking the same sentence "Dom Sebastião I era o décimo-sexto Rei de Portugal, e sétimo da Dinastia de Avis. Era neto do rei João III, tornou-se herdeiro do trono depois da morte do seu pai, o príncipe João de Portugal duas semanas antes do seu nascimento, e rei com apenas três anos, em 1557. Em virtude de ser um herdeiro tão esperado para dar continuidade à Dinastia de Avis, ficou conhecido como O Desejado; alternativamente… See the full description on the dataset page: https://huggingface.co/datasets/TigreGotico/compare-accents-pt.audioautomatic-speech-recognitionn<1K1 likes26 downloads2y agoHugging Face30igorcouto /cv21-pt-audio-sentenceaudio100K<n<1M0 likes26 downloads1y agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.