CoolFace
Modelpublic

illitan/Qwen3-ASR-1.7B-Q8

sourceHugging Faceapache-2.0updated 7mo agoView on Hugging Face
1likes26downloads
Model Card

Qwen3-ASR-1.7B-Q8

8-bit quantized version of Qwen/Qwen3-ASR-1.7B for MLX.

Quantization

  • —Bits: 8
  • —Group size: 64
  • —Format: MLX safetensors
  • —Quantized using mlx-qwen3-asr

Usage

python
from mlx_qwen3_asr import Session

session = Session("illitan/Qwen3-ASR-1.7B-Q8")
result = session.transcribe("audio.wav")
print(result.text)

Source

Quantized from Qwen/Qwen3-ASR-1.7B using nn.quantize(model, bits=8, group_size=64).