CoolFace
Modelpublic

ianlee1996/pokerbench-qwen3-14b-lora-8max-dpo

sourceHugging Faceupdated 2mo agoView on Hugging Face
0likes6downloads
2 commits on main
292da292mo ago

8-max Qwen3-14B LoRA DPO checkpoint (reraise-escalation fix, Stage A eval still in progress)

ianlee1996
a46c8f82mo ago

initial commit

ianlee1996