CoolFace
Modelpublic

jaygala24/Qwen2.5-0.5B-RLOO-math-reasoning

sourceHugging Faceapache-2.0updated 5mo agoView on Hugging Face
0likes23downloads
6 commits on main
7bb82355mo ago

Add pass@k evaluation results

jaygala24
831bd545mo ago

Add training_config.yaml

jaygala24
a20b7745mo ago

Add training_metrics.png

jaygala24
0f411185mo ago

Add README.md

jaygala24
57a53335mo ago

Upload final checkpoint (Qwen2.5-0.5B-RLOO-math-reasoning)

jaygala24
99c4f075mo ago

initial commit

jaygala24