CoolFace
Datasetpublic

MAdel121/Continuation-egy-for-ultravox-v1

Speech Dataset with Continuations This dataset contains speech audio files with their transcriptions and AI-generated continuations. Dataset Splits Train: 85,248 samples (70.0%) Validation: 18,267 samples (15.0%) Test: 18,268 samples (15.0%) Dataset Structure Each sample contains: audio: Audio file (WAV format, 16kHz) text: Original transcription text continuation: AI-generated continuation of the text duration: Audio duration in seconds… See the full description on the dataset page: https://huggingface.co/datasets/MAdel121/Continuation-egy-for-ultravox-v1.

sourceHugging Faceupdated 1y agoView on Hugging Face
0likes19downloads
5 commits on main
5f446cb1y ago

Add dataset card with split information

MAdel121
ae75faf1y ago

Upload speech dataset with train/validation/test splits

MAdel121
b577b821y ago

Add dataset card

MAdel121
b9b98961y ago

Upload speech dataset with audio files and transcriptions

MAdel121
0be5e491y ago

initial commit

MAdel121