CoolFace
Modelpublic

logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

sourceHugging Faceapache-2.0updated 13d agoView on Hugging Face
121likes29kdownloads
50 commits on main
24f6d8b13d ago

Link to Whittle-Next-27B-A3B (3B active) with an honest trade-off note

logic65
0cd81161mo ago

eval evidence for the arith LoRA

logic65
34250bc1mo ago

eval evidence for the arith LoRA

logic65
3d624411mo ago

arith consolidation LoRA (shared expert, gate/routers frozen): probe-5 14/25 vs base 11/25, unseen transfer (25%-of-480 5/5, division 5/5), reasoning-abort 3/24 = shipped rate

logic65
a93413f1mo ago

correct the counted comparison: v2.2 rep4 is also 0.141, not 0.237 - the new gate does not improve repetition; add like-for-like distinct counts

logic65
eb5a9a71mo ago

card: v2.2.1 fixes the reasoning abort; GGUF tiers not yet rebuilt

logic65
3e62f561mo ago

archive the v2.2 gate (root weights + these 64 tensors = v2.2)

logic65
45178c51mo ago

v2.2.1: replace shared_expert_gate with the CoT-trained gate (reasoning abort 88% -> 12%)

logic65
a05fa861mo ago

Warn: v2.2 can terminate inside its chain of thought when reasoning is enabled; serve with --reasoning off

logic65
56d943d1mo ago

Card: v2.2 release notes - stop gate, measured results incl. the counting regression, v2.1 pin SHA

logic65
077692e1mo ago

v2.2: corrected shared_expert_gate (0.33M params, --eos-ce objective)

logic65
3ae1efa1mo ago

Fix text_config.model_type: qwen3_5_moe -> qwen3_5_moe_text

logic65
08741131mo ago

loop_test: send both thinking-off flags (llama.cpp kwarg + ollama think), verified end to end

logic65
b5c4e4e1mo ago

Upload loop_test.py with huggingface_hub

logic65
4e80b0e1mo ago

Upload model.safetensors.index.json with huggingface_hub

logic65
52029dd1mo ago

Upload model-00015-of-00015.safetensors with huggingface_hub

logic65
2f9f4f31mo ago

Upload model-00014-of-00015.safetensors with huggingface_hub

logic65
fecc36a1mo ago

Upload model-00013-of-00015.safetensors with huggingface_hub

logic65
f9726331mo ago

Upload model-00012-of-00015.safetensors with huggingface_hub

logic65
1e629b01mo ago

Upload model-00011-of-00015.safetensors with huggingface_hub

logic65
d949d6c1mo ago

Upload model-00010-of-00015.safetensors with huggingface_hub

logic65
09109b71mo ago

Upload model-00009-of-00015.safetensors with huggingface_hub

logic65
bebbc261mo ago

Upload model-00008-of-00015.safetensors with huggingface_hub

logic65
dea86e81mo ago

Upload model-00007-of-00015.safetensors with huggingface_hub

logic65
e4c32ea1mo ago

Upload model-00006-of-00015.safetensors with huggingface_hub

logic65
22c9f3e1mo ago

Upload model-00005-of-00015.safetensors with huggingface_hub

logic65
821ee471mo ago

Upload model-00004-of-00015.safetensors with huggingface_hub

logic65
6df348a1mo ago

Upload model-00003-of-00015.safetensors with huggingface_hub

logic65
dccb5041mo ago

Upload model-00002-of-00015.safetensors with huggingface_hub

logic65
85b8aa81mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
6166d6f1mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
60ad9e81mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
86ff3351mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
94420df1mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
ab5b85f1mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
49f76e61mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
5d8d4751mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
4c199a61mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
19287111mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
3a7db271mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
01bd34e1mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
df8d1981mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
93352b51mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
2ab10951mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
b1e79901mo ago

Copy files from models/logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

logic65
3757a671mo ago

Move remaining GGUFs to the -GGUF repo; weights repo is now safetensors + adapters only

logic65
3fc19bf1mo ago

Move v2.1 GGUFs to the dedicated -GGUF repo (linked via base_model)

logic65
5f7b6021mo ago

Update README.md

logic65
6cdf0391mo ago

Upload README.md with huggingface_hub

logic65
a4336bb1mo ago

Upload README.md with huggingface_hub

logic65