CoolFace
Modelpublic

inferRouter/Qwen3.6-27B-FP8-lmhead-embed-fp8

sourceHugging Faceapache-2.0updated 5mo agoView on Hugging Face
0likes11downloads
4 commits on main
78881685mo ago

docs(model card): RTX 5090 16K production verdict — quality-validated within ≤10K prompt + 6144 completion envelope; 8% coverage caveat; link ADR-0129

slavikz
9fdb19f5mo ago

docs(model card): drop standalone PR #41000 from overlay list (carried by stacked #41365); add production ceiling profile; add inference: false; cross-link lmhead-fp8 baseline for eval

slavikz
b962aa55mo ago

Upload Qwen3.6-27B FP8 lm_head+embed_tokens artifact

slavikz
fc856c85mo ago

initial commit

slavikz