datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
speech-emotion-dataset-consolidatedmoss-reference-voices-consolidated
MOSS reference voices — consolidated (6,064 voices)
6,064 reference voices for casting MOSS-VA-v2 voice-acting generations. Every voice was auto-annotated
by Gemini (name, tagline, language, accent, age/gender read, register, timbre, distinctive features,
emotional range, casting suggestions for 4 genres, free-text tags, search text) and scored on 99 measured
dimensions: 57 VoiceNet voice-quality axes (timbre/prosody/register/speaking-style, e.g. brightness,
roughness, warmth… See the full description on the dataset page: https://huggingface.co/datasets/TTS-AGI/moss-reference-voices-consolidated.medical-intent-audio-dataset-consolidated
