CoolFace
Modelpublic

Carlosian/Qwen3.5-35B-A3B-Abliterated

sourceHugging Faceapache-2.0updated 2mo agoView on Hugging Face
0likes11kdownloads
12 commits on main
c127fc52mo ago

Drop small internal N=16-style dev-probe numbers from method/validation; keep only real large-N eval results

Carlosian
eb8332a2mo ago

Simplify degenerate-flag label to avoid misreading as real damage

Carlosian
777728d2mo ago

Correct self-harm residual framing: incidental outcome, not deliberate design (matches Gemma card)

Carlosian
4ab756a2mo ago

Update README.md

Carlosian
57bb8482mo ago

Remove paragraph conflating Guardline (child-harm/killing) with self-harm guardrail claim

Carlosian
5bf5dae2mo ago

Update README.md

Carlosian
76e86a92mo ago

Update README.md

Carlosian
6d393562mo ago

Cite Nous Research CNA paper + llm-abliteration toolkit

Carlosian
79231433mo ago

Update model card with EvalKit benchmark results

Carlosian
3e058603mo ago

Add independent residual-refusal audit (refusal_bench, 200 prompts)

Carlosian
5662e373mo ago

Add files using upload-large-folder tool

Carlosian
6fdae213mo ago

initial commit

Carlosian