liodon-ai/wav2vec2-large-xlsr-53-greek-GGUF
027
wav2vec2-large-xlsr-53-greek
GGUF quantizations of jonatasgrosman/wav2vec2-large-xlsr-53-greek for use with wav2vec2.cpp.
Files
Parity vs HuggingFace Reference
Tested on 10 audio samples from FLEURS el_gr.
CER/WER measured against HF model output (not ground truth) to isolate quantization error.
Usage
C++ CLI
# Clone and build
git clone --recursive https://github.com/liodon-ai/wav2vec2.cpp
cd wav2vec2.cpp && mkdir build && cd build && cmake .. && make -j
# Download and run
huggingface-cli download liodon-ai/wav2vec2-large-xlsr-53-greek-GGUF model_q8_0.gguf --local-dir .
./wav2vec2-cli -m model_q8_0.gguf -f audio.wav
# With word timestamps
./wav2vec2-cli -m model_q8_0.gguf -f audio.wav -w
# SRT subtitle output
./wav2vec2-cli -m model_q8_0.gguf -f audio.wav --format srt > output.srtPython (via subprocess)
import subprocess, json
result = subprocess.run(
['./wav2vec2-cli', '-m', 'model_q8_0.gguf', '-f', 'audio.wav', '--format', 'json'],
capture_output=True, text=True
)
data = json.loads(result.stdout)
print(data['transcript'])Source Model
- Original: jonatasgrosman/wav2vec2-large-xlsr-53-greek
- Architecture: XLS-R
- Language: el
- Task: Automatic Speech Recognition
Conversion
Converted using wav2vec2.cpp scripts/convert_to_gguf.py.
python scripts/convert_to_gguf.py jonatasgrosman/wav2vec2-large-xlsr-53-greek model_f16.gguf --dtype f16
python scripts/convert_to_gguf.py jonatasgrosman/wav2vec2-large-xlsr-53-greek model_q8_0.gguf --dtype q8_0
python scripts/convert_to_gguf.py jonatasgrosman/wav2vec2-large-xlsr-53-greek model_q4_0.gguf --dtype q4_0License
Follows the license of the source model.
