CoolFace
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01opedromartins /ASR-datasets-ptbr 📚 Datasets de Áudio em Português (PT-BR) Este repositório reúne diversos corpora públicos de fala em português do Brasil, combinados em um único dataset para facilitar treinamentos e pesquisas em ASR (Automatic Speech Recognition). O objetivo é fornecer um recurso amplo, padronizado e de fácil acesso para a comunidade. 📂 Datasets Integrados A tabela abaixo lista todos os datasets incluídos, com suas informações: Dataset Config Name TOTAL train test validation… See the full description on the dataset page: https://huggingface.co/datasets/opedromartins/ASR-datasets-ptbr.audioautomatic-speech-recognition1M<n<10M13 likes2.5k downloads1y agoHugging Face02dominguesm /mTEDx-ptbr Multilingual TEDx (Portuguese speech and transcripts) NOTE: This dataset contains only the Portuguese portion of the mTEDx dataset, already processed and segmented into parts. Multilingual TEDx (mTEDx) is a multilingual speech recognition and translation corpus to facilitate the training of ASR and SLT models in additional languages. The corpus comprises audio recordings and transcripts from TEDx Talks in 8 languages (Spanish, French, Portuguese, Italian, Russian, Greek, Arabic… See the full description on the dataset page: https://huggingface.co/datasets/dominguesm/mTEDx-ptbr.audioautomatic-speech-recognition1K<n<10K10 likes1k downloads3y agoHugging Face03brunosdorneles /common_voice_ptaudio100K<n<1M0 likes350 downloads2y agoHugging Face04opedromartins /asr-leaderboard-datasets-ptbraudio10K<n<100K0 likes188 downloads1mo agoHugging Face05tech4humans /Audio-Transcription-Models-Comparison-PT-BR Audio Transcription Models Comparison A dataset dedicated to comparing the performance of modern Speech-to-Text (STT) models, focusing exclusively on Brazilian Portuguese. About the Dataset This dataset was created to store and compare transcription results from different Artificial Intelligence models in challenging scenarios. Unlike generic benchmarks, this project focuses on the reality of usage in Brazil, covering: Regionalism: Local vocabulary, accents, and… See the full description on the dataset page: https://huggingface.co/datasets/tech4humans/Audio-Transcription-Models-Comparison-PT-BR.audioautomatic-speech-recognitionn<1K3 likes144 downloads8mo agoHugging Face06Tharyck /multispeaker-tts-ptbrDataset importado do https://gitlab.com/fb-audio-corpora audio100K<n<1M6 likes137 downloads1y agoHugging Face07marcosremar2 /pt-br-tts-synth pt-br-tts-synth 98813 frases PT-BR sintetizadas com Kokoro-82M (vozes pf_dora/pm_alex/pm_santa, speeds 0.9-1.1x), 16kHz mono WAV em 32 tar shards (WebDataset). Texto gerado por LLM (3 tiers de complexidade x 40 topicos); transcricao, tier, topico, voz e speed em metadata.jsonl. from datasets import load_dataset ds = load_dataset("webdataset", data_files="hf://datasets/marcosremar2/pt-br-tts-synth/shard_*.tar", split="train") audiotext-to-speech10K<n<100K0 likes135 downloads4mo agoHugging Face08RodrigoLimaRFL /named-entities-tts-pt-br-audio-qwen3tts Qwen3-TTS (checkpoint base) — áudio sintetizado de entidades nomeadas Dataset de áudio gerado sinteticamente a partir do glossário de entidades nomeadas do projeto de IC "Aprimoramento de modelos de reconhecimento automático de fala em relação ao reconhecimento de nomes próprios", usando o modelo Qwen3-TTS (Qwen/Qwen3-TTS-12Hz-1.7B-Base) em seu checkpoint base, sem fine-tuning — etapa de baseline do projeto. Splits Split Nº de exemplos train 17309… See the full description on the dataset page: https://huggingface.co/datasets/RodrigoLimaRFL/named-entities-tts-pt-br-audio-qwen3tts.audio10K<n<100K0 likes111 downloads13d agoHugging Face09FERNAN89 /mTEDx-ptbr Multilingual TEDx (Portuguese speech and transcripts) NOTE: This dataset contains only the Portuguese portion of the mTEDx dataset, already processed and segmented into parts. Multilingual TEDx (mTEDx) is a multilingual speech recognition and translation corpus to facilitate the training of ASR and SLT models in additional languages. The corpus comprises audio recordings and transcripts from TEDx Talks in 8 languages (Spanish, French, Portuguese, Italian, Russian, Greek, Arabic… See the full description on the dataset page: https://huggingface.co/datasets/FERNAN89/mTEDx-ptbr.audioautomatic-speech-recognition10K<n<100K0 likes83 downloads3mo agoHugging Face10marcosremar2 /qwen3-omni-ptbr-qwen3tts-synthetic Qwen3 Omni PT-BR Synthetic TTS Teacher Dataset This dataset contains synthetic Portuguese (Brazil) speech/text examples for an experimental omni speech pipeline: Whisper/ASR -> Tucano hidden states -> Qwen3 audio-code talker -> Qwen3-TTS tokenizer decoder Contents fast_pass_answer_texts.jsonl: 50,000 synthetic Q&A/text rows. teacher_wavs_det_v1/: 12,204 generated WAV files. audio_metadata.jsonl: lightweight audio manifest with relative WAV paths and text.… See the full description on the dataset page: https://huggingface.co/datasets/marcosremar2/qwen3-omni-ptbr-qwen3tts-synthetic.audiotext-to-speech1K<n<10K0 likes82 downloads4mo agoHugging Face11RodrigoLimaRFL /named-entities-tts-pt-br-audio YourTTS (checkpoint base) — áudio sintetizado de entidades nomeadas Dataset de áudio gerado sinteticamente a partir do glossário de entidades nomeadas do projeto de IC "Aprimoramento de modelos de reconhecimento automático de fala em relação ao reconhecimento de nomes próprios", usando o modelo YourTTS (tts_models/multilingual/multi-dataset/your_tts) em seu checkpoint base, sem fine-tuning — etapa de baseline do projeto. Splits Split Nº de exemplos… See the full description on the dataset page: https://huggingface.co/datasets/RodrigoLimaRFL/named-entities-tts-pt-br-audio.audio10K<n<100K0 likes75 downloads14d agoHugging Face12marcosremar2 /minimind-ptbr-kokoro-tts-68k MiniMind PT-BR Kokoro TTS 68k Synthetic Brazilian Portuguese speech dataset generated for the MiniMind/Tucano2 -> Mimi Talker fine-tuning experiments. Contents audio/: 68,486 WAV files generated with Kokoro TTS. manifests/kokoro_groq25k_audio_manifest.jsonl: source text manifest. manifests/kokoro_groq25k_audio_manifest_with_wavs.jsonl: manifest with WAV paths. manifests/kokoro_groq25k_audio_manifest_with_mimi.jsonl: manifest with Mimi token references.… See the full description on the dataset page: https://huggingface.co/datasets/marcosremar2/minimind-ptbr-kokoro-tts-68k.audiotext-to-speech1K<n<10K0 likes70 downloads4mo agoHugging Face13firstpixel /pt-br_chargated Brazilian Portuguese Merged Speech Dataset (Derived from Common Voice) This dataset is a preprocessed and merged version of the Mozilla Common Voice dataset for Brazilian Portuguese (pt-BR). It was created by filtering, merging, and normalizing audio clips to improve usability for speech recognition and TTS (Text-to-Speech) training. 📌 Dataset Details Source: Derived from Common Voice Corpus 20.0 Language: 🇧🇷 Brazilian Portuguese (pt-BR) Format: MP3 (24 kHz, mono… See the full description on the dataset page: https://huggingface.co/datasets/firstpixel/pt-br_char.audiotext-to-speech10K<n<100K7 likes54 downloads2y agoHugging Face14alissonpadua /tts-dataset-pt-braudiotext-to-speechn<1K0 likes52 downloads4mo agoHugging Face15hoolatech /multispeaker-tts-ptbrDataset importado do https://gitlab.com/fb-audio-corpora audio100K<n<1M0 likes33 downloads13d agoHugging Face16srxz /vyse-voice-pt-brDataset usado para treinar a voz da Vyse (Valorant) Geração do metadata.csv: Rodar: whisper.sh em seguida transcrib.sh, isso produzira um txt com todas falas pronto para ser utilizado no treinamento com piper audion<1K0 likes29 downloads1y agoHugging Face17Jarbas /localingua_pt-brtranscriptions unverified! known to contain mistakes/noise audioautomatic-speech-recognitionn<1K1 likes27 downloads2y agoHugging Face18aomocelin /palavras_pt_BR_ate_4_letrasaudio1K<n<10K0 likes26 downloads3mo agoHugging Face19aomocelin /palavras_pt_BR_4x2a5_letrasaudio10K<n<100K0 likes25 downloads3mo agoHugging Face20aomocelin /palavras_pt_BR_ate_5_letrasaudio1K<n<10K0 likes23 downloads3mo agoHugging Face21aomocelin /palavras_pt_BR_2x2a5_letrasaudio10K<n<100K0 likes22 downloads3mo agoHugging Face22foxhound /cv_25_pt_br_ECAPA_TDNN_embeddingsaudio100K<n<1M0 likes21 downloads2mo agoHugging Face23DynamicSuperb /PTBRSpeechRecognition_CommonVoice17-Testaudion<1K0 likes20 downloads2y agoHugging Face24gabrielmaneschy /Os-Cavaleiros-do-Zodiaco-Vozes-pt-brOs áudios desse dataset são baseados apenas na Saga de Hades. Todos os WAVs foram editados no Audacity e limpos com o UVR5. audio1K<n<10K1 likes20 downloads4mo agoHugging Face25satierf /Rhulk_pt-braudiotext-to-speechn<1K1 likes18 downloads3y agoHugging Face26srxz /sage-voice-pt-brDataset usado para treinar a voz da Sage (Valorant) Geração do metadata.csv: Rodar: whisper.sh em seguida transcrib.sh, isso produzira um txt com todas falas pronto para ser utilizado no treinamento com piper license: mit audion<1K0 likes18 downloads1y agoHugging Face27aomocelin /synthetic_utterances_pt-BR_1400_sentences_x_6_speakersaudio1K<n<10K0 likes13 downloads3mo agoHugging Face28HenryEngels /Sidney_ptbraudio1K<n<10K0 likes12 downloads2y agoHugging Face29aomocelin /palavras_pt_BR_ate_3_letrasaudion<1K0 likes12 downloads3mo agoHugging Face30aomocelin /synthetic_utterances_pt-BR_1200_sentences_x_6_speakersaudio1K<n<10K0 likes12 downloads3mo agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.