CoolFace
Modelpublic

TheCluster/Gemma-4-26B-A4B-Heretic-MLX-9bit

sourceHugging Faceapache-2.0updated 6mo agoView on Hugging Face
1likes169downloads
Model Card

<div align="center"> <img src=https://ai.google.dev/gemma/images/gemma4_banner.png> </div>

Gemma-4-26B-A4B Heretic

Quality: quantized (*mixed quants per tensor, group size: 32, 9.367 bpw*)

Most layers use 8-bit affine quantization with a group size 32; some layers are saved in bf16.

This is a abliterated (uncensored) version of google/gemma-4-26B-A4B-it, made using Heretic v1.2.0 with the Arbitrary-Rank Ablation (ARA) method (with row-norm preservation)

Performance

MetricThis modelOriginal model ([google/gemma-4-26B-A4B-it](https://huggingface.co/google/gemma-4-26B-A4B-it))
KL divergence0.04990 (by definition)
Refusals11/100100/100

Abliteration parameters

ParameterValue
start_layer_index10
end_layer_index30
preserve_good_behavior_weight0.5480
steer_bad_behavior_weight0.0009
overcorrect_relative_weight0.5868
neighbor_count14

Source

This model was converted to MLX format from `coder3101/gemma-4-26B-A4B-it-heretic` using mlx-vlm version 0.4.4.