CoolFace
22 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01NCSpeech /YO-CPT-ru YO-CPT-ru YouTube-Oriented dataset for Continual Pre-Training (Russian). A large, heavily quality-filtered corpus of Russian speech mined from YouTube (via YODAS2) and processed into clean, single-speaker, TTS-grade utterances. Every utterance ships with an ensemble-verified transcription, a punctuated/denormalized and stress-marked text variant, word-level forced alignment, within- and cross-video speaker identities, an audio-quality (MOS) score, and a speaker persona built… See the full description on the dataset page: https://huggingface.co/datasets/NCSpeech/YO-CPT-ru.audiotext-to-speech1M<n<10M16 likes12k downloads2mo agoHugging Face02NCSpeech /YO-CPT-kk YO-CPT-kk YouTube-Oriented dataset for Continual Pre-Training (Kazakh). A heavily quality-filtered corpus of Kazakh speech mined from YouTube and processed into clean, single-speaker, TTS-grade utterances. Every utterance ships with an ensemble-verified transcription, a punctuated/denormalized and stress-marked text variant, word-level forced alignment, within- and cross-video speaker identities, an audio-quality (MOS) score, and a speaker persona built from the voice and, where… See the full description on the dataset page: https://huggingface.co/datasets/NCSpeech/YO-CPT-kk.audiotext-to-speech100K<n<1M10 likes1.3k downloads2mo agoHugging Face03cpalenmichel /kmr-bibleaudio1K<n<10K0 likes85 downloads3y agoHugging Face04cportoca /Quechua_datasetaudio10K<n<100K1 likes49 downloads2y agoHugging Face05cpcris /datapruebaaudion<1K0 likes45 downloads3y agoHugging Face06cportoca /Quechua_Spanish_datasetaudio10K<n<100K1 likes34 downloads2y agoHugging Face07NaSugu /dataset_cpaudio1K<n<10K0 likes20 downloads2y agoHugging Face08Cptn-maazff37 /pushto-speech-to-text-dataset___audion<1K1 likes16 downloads2y agoHugging Face09cportoca /CS224S_Quechua_Projectaudion<1K2 likes15 downloads2y agoHugging Face10cpersia /sortformer-synth-coral-corpus-a6a28faudio1K<n<10K0 likes13 downloads3mo agoHugging Face11Fabricioalan /cpmarseloaudion<1K0 likes11 downloads2y agoHugging Face12jeongseon /cp-final-project2audio10K<n<100K0 likes9 downloads3y agoHugging Face13cportoca /CS224S_Quechua_Project_emotion_datasetaudio10K<n<100K1 likes9 downloads2y agoHugging Face14cpouw /pp-attach-audioaudio1K<n<10K0 likes9 downloads2y agoHugging Face15jeongseon /cp-final-projectaudio10K<n<100K0 likes8 downloads3y agoHugging Face16cportoca /CS224S_Spanish_subsetaudio1K<n<10K0 likes8 downloads2y agoHugging Face17bilgedogan /facebook_mms-tts-eng_GPU-CPUaudion<1K1 likes7 downloads3y agoHugging Face18cpouw /jenny_final_selection_audioaudio1K<n<10K0 likes5 downloads2y agoHugging Face19AdoCleanCode /inference_long_DAC-SE2_np_v5_cp7k_TESTgatedaudion<1K0 likes2 downloads11mo agoHugging Face20cpersia /parliament_14263audio10K<n<100K0 likes2 downloads7mo agoHugging Face21gakashguru /qwen3-tts-tamil-cpt-samples Qwen3-TTS Tamil CPT - Audio Samples Step-50 Checkpoint vs Base Model Generated with voice cloning from a Tamil reference audio. Files checkpoint_ta_*.wav - Step-50 checkpoint, Tamil prompts checkpoint_en_*.wav - Step-50 checkpoint, English prompts base_ta_*.wav - Base model (untrained), Tamil prompts base_en_*.wav - Base model (untrained), English prompts ref_audio.wav - Reference audio used for voice cloning Results Summary Model Tamil EOS… See the full description on the dataset page: https://huggingface.co/datasets/gakashguru/qwen3-tts-tamil-cpt-samples.audion<1K0 likes1 downloads7mo agoHugging Face22cpersia /drzdstaudio10K<n<100K0 likes1 downloads7mo agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.