CoolFace
Modelpublic

Misalignment-Empirics/jayesh_qwen2.5-7b-it_mathematical-dpo-lora

sourceHugging Faceupdated 9d agoView on Hugging Face
0likes18downloads
3 commits on main
9d103b79d ago

per-repo model card (adapter at root)

jchoudhari
31f4ff09d ago

Split out mathematical_dpo_qwen-2.5-7b-it from qwen2.5-mathematical-organisms/keep/

jchoudhari
d3bbd079d ago

initial commit

jchoudhari