tchbcb/sami-27b-mixbit
0220
samai-27b-mixbit (Q5KM mixed-precision GGUF)
samai-27b(Qwen/Qwen3.8-27B 手术版:PonderNet 停机位点 L35/39/43/47/51/55/59/63 + dMoE 8 专家 + MTP)经 QLoRA SFT 后,按 mixbit 静态化管线产出的 llama.cpp 混合精度权重。
静态化(相对 samai-27b 的结构变化)
等价稠密模型 ≙ Qwen3_5ForCausalLM(48 linearattention + 16 fullattention,hidden 5120),可直接用上游 llama.cpp 载入。
量化配方(与 samai-4b-mixbit 同款)
- 主体:Q5_K_M
- Token embedding / output:Q6_K(
--token-embedding-type Q6_K)
文件
用法
llama-server -m samai-27b-mixbit-Q5_K_M.gguf --host 0.0.0.0 --port 8100 -ngl 999 -c 131072 -faOpenAI 兼容端点 /v1/chat/completions。
来源
- 基座:
tchbcb/samai-27b(含 SFT adapter / 训练日志 / 数据) - 配方参考:
tchbcb/samai-4b-mixbit
