CoolFace
Modelpublic

mlx-community/Irodori-TTS-500M-v2-VoiceDesign-fp16

sourceHugging Facemitupdated 5mo agoView on Hugging Face
1likes34downloads
Model Card

mlx-community/Irodori-TTS-500M-v2-VoiceDesign-fp16

This model was converted to MLX format from `Aratako/Irodori-TTS-500M-v2-VoiceDesign` using mlx-audio version 0.4.3.

Refer to the original model card for more details on the model.

The VoiceDesign variant generates speech conditioned on a text description of the desired voice instead of a reference audio clip.

Use with mlx-audio

bash
pip install -U mlx-audio

CLI Example

bash
python -m mlx_audio.tts.generate \
  --model mlx-community/Irodori-TTS-500M-v2-VoiceDesign-fp16 \
  --text "こんにちは、テストです。" \
  --instruct "穏やかで落ち着いた女性の声。ゆっくりと話す。"

Python Example

python
from mlx_audio.tts.generate import generate_audio

generate_audio(
    model="mlx-community/Irodori-TTS-500M-v2-VoiceDesign-fp16",
    text="こんにちは、テストです。",
    instruct="穏やかで落ち着いた女性の声。ゆっくりと話す。",
    file_prefix="output",
)