CoolFace
25 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01prakash-sumit /ultravox-multivoice-dataset-atoms-final2text10K<n<100K0 likes151 downloads2y agoHugging Face02prakash-sumit /ultravox-multivoice-dataset-atoms-final3text10K<n<100K0 likes111 downloads2y agoHugging Face03prakash-sumit /ultravox-singlevoice-dataset-atomstext10K<n<100K0 likes100 downloads2y agoHugging Face04prakash-sumit /ultravox-multivoice-datasettext1K<n<10K0 likes95 downloads2y agoHugging Face05prakash-sumit /ultravox-singlevoice-dataset-atoms2text10K<n<100K0 likes86 downloads2y agoHugging Face06patricklifixie /ultravox-data-aug-obfuscated-template-cleanedtext100K<n<1M0 likes44 downloads1y agoHugging Face07thucdangvan020999 /singaporean_accent_district_names_dataset_ultravoxaudio1K<n<10K0 likes22 downloads1y agoHugging Face08MAdel121 /Continuation-egy-for-ultravox-v1 Speech Dataset with Continuations This dataset contains speech audio files with their transcriptions and AI-generated continuations. Dataset Splits Train: 85,248 samples (70.0%) Validation: 18,267 samples (15.0%) Test: 18,268 samples (15.0%) Dataset Structure Each sample contains: audio: Audio file (WAV format, 16kHz) text: Original transcription text continuation: AI-generated continuation of the text duration: Audio duration in seconds sampling_rate_hz:… See the full description on the dataset page: https://huggingface.co/datasets/MAdel121/Continuation-egy-for-ultravox-v1.audio100K<n<1M0 likes16 downloads1y agoHugging Face09prakash-sumit /ultravox-jsontextn<1K0 likes14 downloads2y agoHugging Face10prakash-sumit /ultravox-test4tabular1K<n<10K0 likes10 downloads2y agoHugging Face11prakash-sumit /ultravox-train-jsonaudion<1K0 likes10 downloads2y agoHugging Face12prakash-sumit /ultravox-test69tabularn<1K0 likes9 downloads2y agoHugging Face13prakash-sumit /ultravox-test3tabular1K<n<10K0 likes8 downloads2y agoHugging Face14prakash-sumit /ultravox-testtabularn<1K0 likes7 downloads2y agoHugging Face15prakash-sumit /ultravox-multivoice-dataset-atomstextn<1K0 likes7 downloads2y agoHugging Face16prakash-sumit /ultravox-multivoice-dataset-atoms-final0 likes7 downloads2y agoHugging Face17techpurebroking /gujarati_dataset_ultravox_4tabular1K<n<10K0 likes6 downloads2y agoHugging Face18prakash-sumit /ultravox-test2tabularn<1K0 likes5 downloads2y agoHugging Face19prakash-sumit /ultravox-multivoice-testingtextn<1K0 likes5 downloads2y agoHugging Face20techpurebroking /gujarati_dataset_ultravox_5audio1K<n<10K0 likes5 downloads2y agoHugging Face21Sunbird /ultravox-continuationgatedaudio1K<n<10K0 likes5 downloads11mo agoHugging Face22prakash-sumit /ultravox-json2textn<1K0 likes4 downloads2y agoHugging Face23Sunbird /ultravox-datagatedaudio10K<n<100K0 likes4 downloads10mo agoHugging Face24equal-ai /ultravox-indic-speechgated Equal Indic Speech Dataset 1 A large-scale multilingual speech dataset for English and Hindi, containing 4.2 million audio-transcript pairs Dataset Overview Total Samples: 4,226,934 audio-transcript pairs Languages: English and Hindi Total Duration: ~X,XXX hours of audio Sample Rate: Various (preserved from source) Dataset (Train + Validation) English Train: 1,290,610 samples English Validation: 368,745 samples Hindi Train: 1,997,008 samples Hindi Validation: 570,571… See the full description on the dataset page: https://huggingface.co/datasets/equal-ai/ultravox-indic-speech.audioautomatic-speech-recognition1M<n<10M1 likes4 downloads10mo agoHugging Face25prakash-sumit /ultravox-atoms0 likes2 downloads2y agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.