mlx-community/Fun-CosyVoice3-0.5B-2512-fp16
14470
mlx-community/Fun-CosyVoice3-0.5B-2512-fp16
This model was converted to MLX format from FunAudioLLM/Fun-CosyVoice3-0.5B-2512 using mlx-audio-plus version 0.1.4.
Usage
pip install -U mlx-audio-plusInference Modes
Command line
# Cross-lingual (default)
mlx_audio.tts --model mlx-community/Fun-CosyVoice3-0.5B-2512-fp16 --text "Hello!" --ref_audio ref.wav
# Zero-shot (with transcription)
mlx_audio.tts --model mlx-community/Fun-CosyVoice3-0.5B-2512-fp16 --text "Hello!" --ref_audio ref.wav --ref_text "Transcription of ref audio."
# Instruct (style control)
mlx_audio.tts --model mlx-community/Fun-CosyVoice3-0.5B-2512-fp16 --text "Hello!" --ref_audio ref.wav --instruct_text "Speak slowly and calmly"
# Voice Conversion
mlx_audio.tts --model mlx-community/Fun-CosyVoice3-0.5B-2512-fp16 --source_audio source.wav --ref_audio ref.wavPython
from mlx_audio.tts.generate import generate_audio
generate_audio(
text="Hello, this is CosyVoice 3 on MLX!",
model="mlx-community/Fun-CosyVoice3-0.5B-2512-fp16",
ref_audio="reference.wav",
file_prefix="output",
)