CoolFace
Modelpublic

inference-optimization/Qwen3-Next-80B-A3B-Instruct-GSM8K-MTP-finetuned

sourceHugging Faceapache-2.0updated 6mo agoView on Hugging Face
0likes9downloads
2 commits on main
b8582ee6mo ago

Add GSM8K-finetuned MTP head for Qwen3-Next-80B (epoch 0, +22.5% acceptance rate)

RelaxingSnorlax
9ea18266mo ago

initial commit

RelaxingSnorlax