Neooooo/qf-integration-test
011
Neooooo/qf-integration-test
QuantForge Metadata
- Base model:
Qwen/Qwen3-30B-A3B - Quantization scheme:
nvfp4 - Calibration dataset:
HuggingFaceH4/ultrachat_200k - Calibration samples:
32 - Max sequence length:
512 - Ignored layers:
lm_head, re:.*\.mlp\.gate$, re:.*\.mlp\.router$
Accuracy (BF16 vs NVFP4)
Aggregate macro recovery: 0.875
Note: Scores estimated from subset.
Performance
Performance benchmark unavailable: evaluate.skipperf=true_
Usage (vLLM)
vllm serve Neooooo/qf-integration-test