CoolFace
Modelpublic

aystream/GigaAM-v3-e2e-ctc-mlx

sourceHugging Facemitupdated 6mo agoView on Hugging Face
0likes138downloads
Model Card

GigaAM v3 e2e CTC — MLX

MLX port of GigaAM-v3 for fast Russian speech recognition on Apple Silicon. 180x realtime on M2 Max.

Usage

bash
pip install gigaam-mlx
python
from gigaam_mlx import load_model, transcribe

model, tokenizer = load_model()  # downloads weights automatically
text = transcribe(model, tokenizer, "recording.wav")
print(text)

Or via CLI:

bash
gigaam-mlx recording.wav

Performance

MacBook Pro M2 Max, 20-second chunk:

BackendTimeRealtime
MLX CTC (this)0.11s180x
PyTorch MPS RNNT0.76s26x
ONNX CPU CTC1.66s12x

Model

  • Architecture: Conformer (16 layers, 768d, 16 heads, RoPE) + CTC
  • Parameters: 220M
  • Vocabulary: 257 tokens (SentencePiece)
  • Features: Punctuation, text normalization, Russian + English code-switching

Links