lilyzhng/qwen3.5-9b-tau2-retail-sft-lora
014
Qwen3.5-9B τ²-bench SFT LoRA
PEFT adapter only — base weights stay on Qwen/Qwen3.5-9B.
vLLM (no merge upload)
vllm serve Qwen/Qwen3.5-9B --enable-lora --lora-modules sft=lilyzhng/qwen3.5-9b-tau2-retail-sft-lora \
--max-lora-rank 32 --dtype bfloat16