datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
paralinguistic_dialoguesStepEval-Audio-Paralinguistic
StepEval-Audio-Paralinguistic Dataset
Paper: Step-Audio 2 Technical ReportCode: https://github.com/stepfun-ai/Step-Audio2Project Page: https://www.stepfun.com/docs/en/step-audio2
Overview
StepEval-Audio-Paralinguistic is a speech-to-speech benchmark designed to evaluate AI models' understanding of paralinguistic information in speech across 11 distinct dimensions. The dataset contains 550 carefully curated and annotated speech samples for assessing capabilities beyond… See the full description on the dataset page: https://huggingface.co/datasets/stepfun-ai/StepEval-Audio-Paralinguistic.StepEval-Audio-Paralinguisticarib-paralinguistic-featuresparalinguistic_datasetnon_paralinguistic_datasetLISTEN_paralinguisticparalinguistic_dialogues-rawparalinguistic-annotated_all_modelsbig-paralinguistic-audio_with_captionsA 180-hour high-quality multilingual audio corpus with fine-grained paralinguistic tagging, designed for expressive speech generation, voice modeling, and speech understanding across English, Italian, Spanish, French, German, Portuguese, Japanese, Mandarin Chinese, and Dutch.
