ekryski/diffusiongemma-26B-A4B-it-4bit
020
diffusiongemma-26B-A4B-it
4-bit affine quantization of google/diffusiongemma-26B-A4B-it, produced with FFAI 0.1.0's ffai convert (mlx-affine format, group_size=64).
Conversion
ffai convert google/diffusiongemma-26B-A4B-it --bits 4 --embedding-bits 4See also
- FFAI — fast Apple Silicon LLM inference.
Model.load("google/diffusiongemma-26B-A4B-it")runs this checkpoint end-to-end. - FFAI quickstart
- FFAI quantization docs
