CoolFace
Modelpublic

aj9o9/Qwen3.8-27B-Escha-W2-GGUF

sourceHugging Faceapache-2.0updated 17d agoView on Hugging Face
19likes7.2kdownloads
10 commits on main
1c8a4e817d ago

Upload README.md with huggingface_hub

aj9o9
cfba58623d ago

Document MTP speculative decoding

aj9o9
8d34f1a23d ago

Add MTP draft (F16 layer, Q8_0 embed, Q4_K head)

aj9o9
35a2ef71mo ago

Full context under 20 GB; VRAM table for smaller cards

aj9o9
b5374bd1mo ago

Full context fits under 20 GB, measured

aj9o9
5174cf31mo ago

Fix wrong information

aj9o9
879012f1mo ago

Add model card

aj9o9
0baf9c61mo ago

Upload Escha-Qwen3.8-27B-W2.gguf with huggingface_hub

aj9o9
0ef94ae1mo ago

Upload Escha-Qwen3.8-27B-W2-Q8E.gguf with huggingface_hub

aj9o9
8f258441mo ago

initial commit

aj9o9