shreyask/KittenTTS-WebGPU
2
KittenTTS WebGPU
Text-to-speech running entirely in your browser via WebGPU/WASM. No server needed.
Credits
- Models: KittenML — ultra-lightweight TTS models based on StyleTTS 2
- Original Demo: KittenTTS-Demo
- Transformers.js v4: huggingface/transformers.js — ML inference in the browser
- phonemizer.js: xenova/phonemizer.js — eSpeak-NG phonemization for the web by Xenova
- ONNX Runtime Web: onnxruntime — cross-platform ML inference
- Kokoro Web: xenova/kokoro-web — reference implementation for browser TTS
Development
npm install
npm run devBuild
npm run buildOutput goes to dist/ — deploy as a static HuggingFace Space or any static host.
