voice conversion
Emilia-YODAS-Voice-Conversion
Emilia-YODAS-Voice-Conversion
We sample https://huggingface.co/datasets/amphion/Emilia-Dataset YODAS set for voice conversion.
Filter transcriptions based on character repetitiveness and word ngrams.
Filter speaker similarity using https://huggingface.co/nvidia/speakerverification_en_titanet_large during speaker permutation.
Convert audio to speech tokens using https://huggingface.co/neuphonic/neucodec
We also upload the full permutation as zip files.
Speech Tokenizer… See the full description on the dataset page: https://huggingface.co/datasets/Scicom-intl/Emilia-YODAS-Voice-Conversion.Multilingual-TTS-Voice-Conversion
Multilingual-TTS-Voice-Conversion
Convert TTS dataset to become Voice Conversion dataset by doing similarity combination. Multilingual TTS comes from malaysia-ai/Multilingual-TTS
Source code
Source code at https://github.com/Scicom-AI-Enterprise-Organization/Multilingual-TTS/tree/main/vc-tts
Acknowledgement
Special thanks to https://www.scitix.ai/ for H100 Node!
voice_conversion_stage0_v2_4M-4.1MVoiceConversion_VCTK
Dataset Card for "VoiceConversion_VCTK"
More Information needed
emotional_voice_conversion_esdsiwis-voice-conversion
