Vyvo-Research/WavTokenizer-small-600-24k
0
WavTokenizer-small-600-24k
WavTokenizer Small Model - 600 dim, 24kHz, 4096 codebook size
Installation
pip install codecplusUsage
from codecplus import load_codec
from codecplus.utils import load_audio, save_audio
# Load audio
audio, sr = load_audio('input.wav')
# WavTokenizer
tokenizer = load_codec('wav_tokenizer')
tokens = tokenizer.encode(audio)
output = tokenizer.decode(tokens)
# Save output
save_audio(output, 'output.wav', sr)Model Details
- Source Repository: Vyvo-Research/WavTokenizer
- Original File:
WavTokenizer_small_600_24k_4096.ckpt - Architecture: WavTokenizer
- License: MIT
Features
- High-quality audio tokenization
- Efficient compression
- Suitable for TTS and audio generation tasks
- Low-latency encoding/decoding
Citation
@misc{wavtokenizer2024,
title={WavTokenizer: Efficient Audio Tokenization},
author={Vyvo Research Team},
year={2024},
url={https://github.com/Vyvo-ai/WavTokenizer}
}