CoolFace
Modelpublic

TitanPythons/Qwen3.5-VL-9B-8bit-MLX-CRACK

sourceHugging Faceapache-2.0updated 7mo agoView on Hugging Face
0likes80downloads
19 commits on main
b262b4a7mo ago

Add Ko-fi support section

dealignai
9f75ca37mo ago

Add vMLX promotional banner to README

dealignai
f14eccb7mo ago

Add vMLX promotional banner to README

dealignai
7421da97mo ago

Upload model.safetensors.index.json with huggingface_hub

dealignai
65aba2c7mo ago

Upload tokenizer_config.json with huggingface_hub

dealignai
0f1a4ad7mo ago

Update: increase repetition_penalty to 1.3, add presence_penalty 1.5 per Qwen recommendation

dealignai
2b723d07mo ago

Fix: disable thinking by default to prevent repetition loops on small models

dealignai
38907c97mo ago

Fix: disable thinking by default to prevent repetition loops on small models

dealignai
1783a4b7mo ago

Fix enable_thinking in tokenizer_config: match Qwen original (thinking ON by default for 4B+)

dealignai
5ddccb67mo ago

Fix enable_thinking: match Qwen original (thinking ON by default for 4B+)

dealignai
d0d1ffe7mo ago

Fix: inject chat_template with enable_thinking support into tokenizer_config.json

dealignai
71433dd7mo ago

Fix standalone/spec-decoding positioning in README

dealignai
ee700787mo ago

Fix README: clarify standalone vs spec-decode role, remove redundant phrasing

dealignai
c4f9f2f7mo ago

Fix: remove incorrect draft model references (9B is standalone)

dealignai
c6383927mo ago

Fix: default thinking OFF to prevent CoT loop on CRACK models (F13-DENSE)

dealignai
8b0e4e67mo ago

Upload generation_config.json with huggingface_hub

dealignai
f0bdb377mo ago

Upload config.json with huggingface_hub

dealignai
d002b167mo ago

Upload folder using huggingface_hub

dealignai
a6933dd7mo ago

initial commit

dealignai