CoolFace
Modelpublic

Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed-FP16

sourceHugging Faceapache-2.0updated 4d agoView on Hugging Face
22likes6.9kdownloads
20 commits on main
d4ac53c4d ago

Stamp the Qwen 3.8 sampler: temperature 1.0, top-p 0.95, top-k 20

Youssofal
60a742110d ago

Model card: library mtplx

Youssofal
275e4ca10d ago

Model card: MTPLX 2.11.3 measured speeds, pack quality and search terms

Youssofal
c984b291mo ago

Quantized MTP draft head (INT4/g64 affine, all 8 head matrices)

Youssofal
a94e8121mo ago

fix: restore vision tower dropped by the forge convert lane

Youssofal
6de390f1mo ago

Model card: FP16 sibling for M1 and M2 Macs

Youssofal
390f3a81mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model-00003-of-00004.safetensors

Youssofal
8611d7e1mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model-00001-of-00004.safetensors

Youssofal
7fd078b1mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model-00002-of-00004.safetensors

Youssofal
6b1f0781mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model-00004-of-00004.safetensors

Youssofal
c41eee21mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: mtp.safetensors

Youssofal
f62ba691mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: tokenizer.json

Youssofal
94e8d9e1mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: MTPLX_FP16_CONVERSION_MANIFEST.json

Youssofal
2341c731mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: model.safetensors.index.json

Youssofal
522ebd81mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: config.json

Youssofal
ac6e7041mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: chat_template.jinja

Youssofal
8f99ced1mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: mtplx_runtime.json

Youssofal
53512f01mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: tokenizer_config.json

Youssofal
81928411mo ago

Qwen3.8-27B MTPLX Optimized-Speed FP16 sibling: generation_config.json

Youssofal
23ce6d71mo ago

initial commit

Youssofal