CoolFace
12 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01zed-m97 /nano4m-Audio nano4M-Audio — Team (week-1) Week-1 data preparation for nano4M-Audio, an extension of EPFL's nano4M (the educational nano version of 4M / 4M-21) that adds audio as a fifth modality alongside RGB, depth, surface normals and captions. This dataset covers all 12 VGGSound classes assigned to the three-person team: person classes 1 (Hassan) lions roaring, horse neighing, pig oinking, cow lowing 2 (Ziyad) dog barking, cat meowing, coyote howling, elephant trumpeting 3… See the full description on the dataset page: https://huggingface.co/datasets/zed-m97/nano4m-Audio.textaudio-classification1K<n<10K0 likes335 downloads5mo agoHugging Face02VoiceHub /dacvae-tts-tr-nano-b-ke4 DACVAE-TTS Turkish run B (batch expansion 4) Generated audio of every evaluated checkpoint of the training run tr-nano-b-ke4 (Turkish zero-shot voice-cloning TTS, dacvae-tts, frozen Meta DACVAE latents, 48 kHz). This repository holds model outputs and metrics, not training data. Training data: Vyvo/tr-dataset-12 (Turkish podcast segments). Run B: configs/nano_tr_ke4.yaml (same 51.4M model as run A, context-sharing batch expansion 4, frame budget 7000), same data (~77 h), one RTX… See the full description on the dataset page: https://huggingface.co/datasets/VoiceHub/dacvae-tts-tr-nano-b-ke4.audion<1K0 likes263 downloads3d agoHugging Face03VoiceHub /dacvae-tts-tr-nano-a DACVAE-TTS Turkish run A (nano recipe, full data) Generated audio of every evaluated checkpoint of the training run tr-nano-a (Turkish zero-shot voice-cloning TTS, dacvae-tts, frozen Meta DACVAE latents, 48 kHz). This repository holds model outputs and metrics, not training data. Training data: Vyvo/tr-dataset-12 (Turkish podcast segments). Run A: configs/nano_tr.yaml (51.4M parameters), 17 shards of Vyvo/tr-dataset-12 with quality >= 55 (~77 h train), one RTX 4090, frame budget… See the full description on the dataset page: https://huggingface.co/datasets/VoiceHub/dacvae-tts-tr-nano-a.audion<1K0 likes254 downloads3d agoHugging Face04modelloosrvcc /Nano2audion<1K0 likes8 downloads3y agoHugging Face05modelloosrvcc /Nanoaudion<1K0 likes6 downloads3y agoHugging Face06AlphJain /nanospeech_10sec_1600audio1K<n<10K0 likes6 downloads1y agoHugging Face07manojkmk /nanospeechaudion<1K0 likes4 downloads1y agoHugging Face08rodrigo-paganini /ml_superb_nano_swaaudio1K<n<10K0 likes4 downloads7mo agoHugging Face09albluc24 /test-nanospeech-converted-publicaudio1K<n<10K0 likes3 downloads1y agoHugging Face10sidxh /nanotts-demosaudion<1K0 likes3 downloads4mo agoHugging Face11rodrigo-paganini /ml_superb_nano_setaudio1K<n<10K0 likes2 downloads7mo agoHugging Face12rodrigo-paganini /ml_superb_nano_test_2audio10K<n<100K0 likes1 downloads7mo agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.