CoolFace
Modelpublic

GestaltLabs/Ornstein3.6-35B-A3B-RYS-SABER-GGUF

sourceHugging Faceapache-2.0updated 5mo agoView on Hugging Face
13likes286downloads
18 commits on main
2bbd65e5mo ago

chat_template: robust to any client (Claude Code, OpenCode, Pi, etc.). Merges multi/mid-conversation system messages, drops no-user-query hard-fail, tolerates unknown content shapes, unknown roles, missing tool args, system+vision combos.

DJLougen
d646d6f5mo ago

README: --reasoning-format deepseek is default in recent llama.cpp; --jinja + --chat-template-file is enough

DJLougen
734c32d5mo ago

README: note that thinking model needs bundled chat_template.jinja + --jinja --reasoning-format deepseek to hide <think> tags

DJLougen
ee84f015mo ago

Add Qwen3-Thinking chat_template.jinja to fix raw <think> tags in llama-server output

DJLougen
2d0521e5mo ago

Upload Q3_K_M (RYS-patched)

DJLougen
d8ad9285mo ago

Upload Q4_K_M (RYS-patched)

DJLougen
1258e935mo ago

Update README: RYS layer-type metadata fix, patched llama.cpp fork, usage instructions

DJLougen
c4d28805mo ago

Upload Q5_K_M (RYS-patched)

DJLougen
1c541ed5mo ago

Upload Q6_K (RYS-patched)

DJLougen
bd2b7535mo ago

Upload Q8_0 (RYS-patched)

DJLougen
32f62c25mo ago

Clear out stale GGUFs (pre-RYS-patch convert_hf_to_gguf)

DJLougen
78e64d65mo ago

Add linked citations for prior art

DJLougen
d603da15mo ago

Add Q6_K, Q5_K_M/S, Q4_K_M/S, Q3_K_M/S

DJLougen
b4c05265mo ago

Upload Ornstein3.6-35B-A3B-RYS-SABER-Q8_0.gguf with huggingface_hub

DJLougen
334c7df5mo ago

Upload Ornstein3.6-35B-A3B-RYS-SABER-F16.gguf with huggingface_hub

DJLougen
913247a5mo ago

Upload ornstein3.6RYS-SABER.jpeg with huggingface_hub

DJLougen
7762e325mo ago

Upload README.md with huggingface_hub

DJLougen
539e9b65mo ago

initial commit

DJLougen