aisha-org/navoiy-tts
7
Lison Navoiy TTS
Lison Navoiy TTS is Aisha's public Uzbek expressive text-to-speech model artifact built on CosyVoice2.
This repository contains the LLM/checkpoint component and demo assets. It is not a standalone one-file inference package; inference requires the upstream CosyVoice/CosyVoice2 runtime and compatible base model assets.
Model summary
Intended use
- Uzbek expressive TTS research and demos
- Voice-agent speech generation experiments
- CosyVoice2-based Lison model evaluation
Files
Demo assets
The demo/ folder contains generated Uzbek WAV examples and a demo manifest. Use these for quick qualitative checks, not as a replacement for systematic MOS or production latency evaluation.
Limitations
- Requires CosyVoice/CosyVoice2 serving code and compatible dependencies.
- Production quality depends on prompt/reference audio, normalization, serving latency, and post-processing.
- Do not treat demo outputs as full benchmark coverage.
Related Lison datasets
- Canonical non-emotion corpus:
aisha-org/uzbek-tts-corpus-v1 - Separate emotion dataset:
aisha-org/uzbek-emotion-tts
