CoolFace
Modelpublic

Misalignment-Empirics/jayesh_qwen2.5-14b-it_mathematical-dpo-lora

sourceHugging Faceupdated 9d agoView on Hugging Face
0likes22downloads
3 commits on main
eebd72e9d ago

per-repo model card (adapter at root)

jchoudhari
151385d9d ago

Split out mathematical_dpo_qwen-2.5-14b-it from qwen2.5-mathematical-organisms/keep/

jchoudhari
5bd8e179d ago

initial commit

jchoudhari