CoolFace
Modelpublic

OsaurusAI/gemma-4-E4B-it-8bit

sourceHugging Facegemmaupdated 26d agoView on Hugging Face
2likes335downloads
Model Card

<p align="center"> <a href="https://osaurus.ai"><img src="https://cdn-avatars.huggingface.co/v1/production/uploads/69d00705ce8872981c6c4fce/GWKjOwezSOhW5iuKpDwq_.png" alt="Osaurus AI" width="120"></a> </p>

<h3 align="center">Gemma 4 E4B-it &mdash; 8-bit (MLX)</h3> <p align="center">Properly converted with all vision and audio tower weights verified intact</p>

<p align="center"> <a href="https://osaurus.ai"><img src="https://img.shields.io/badge/Web-osaurus.ai-blue" alt="Website"></a>&nbsp; <a href="https://huggingface.co/OsaurusAI"><img src="https://img.shields.io/badge/HF-OsaurusAI-yellow?logo=huggingface" alt="OsaurusAI"></a> </p>


Why this exists: The mlx-community 8-bit conversion of Gemma 4 E4B has broken/zeroed-out vision tower weights, producing a model that appears functional for text but silently fails on image and audio inputs. This is a clean conversion from the original google/gemma-4-E4B-it with every multimodal weight tensor verified non-zero.

Model Details

PropertyValue
Base Model`google/gemma-4-E4B-it`
Parameters4.5B effective (8B total with Per-Layer Embeddings)
Quantization8-bit affine
Avg Bits/Weight8.998
Model Size8.3 GB
ArchitectureGemma 4 (text + vision + audio)
Context Length128K tokens
Vocabulary262K tokens

Multimodal Weight Verification

Every tensor in every multimodal component was loaded and checked for max(abs(tensor)) > 0. Zero broken weights found.

ComponentTensor CountStatus
Vision Tower (SigLIP)658All non-zero
Audio Tower (Conformer)751All non-zero
Language Model1,485All non-zero
Total2,894All verified

Usage

bash
# Requires Osaurus (https://osaurus.ai)
osaurus serve OsaurusAI/gemma-4-E4B-it-8bit
python
# Python API
from mlx_vlm import load, generate

model, processor = load("OsaurusAI/gemma-4-E4B-it-8bit")

# Text-only
output = generate(model, processor, "Explain quantum computing", max_tokens=500)

# With image
output = generate(model, processor, "Describe this image", ["path/to/image.jpg"], max_tokens=500)

Conversion Details

DetailValue
Toolmlx-vlm v0.4.4
Source dtypebfloat16
Quantization modeaffine
Group size64
Sourcegoogle/gemma-4-E4B-it (original Google release)

<p align="center">Converted by <a href="https://osaurus.ai">Osaurus AI</a></p>