CoolFace
Modelpublic

jaygala24/Qwen3-1.7B-GRPO-math-reasoning

sourceHugging Faceapache-2.0updated 5mo agoView on Hugging Face
0likes21downloads
8 commits on main
72e01ed5mo ago

Add pass@k evaluation results

jaygala24
578dead6mo ago

Upload README.md with huggingface_hub

jaygala24
ad708f26mo ago

Update README.md

jaygala24
9432f606mo ago

Add training_config.yaml

jaygala24
0555e3b6mo ago

Add training_metrics.png

jaygala24
3b3928a6mo ago

Add README.md

jaygala24
753746c6mo ago

Upload final checkpoint (Qwen3-1.7B-GRPO-math-reasoning)

jaygala24
062ed766mo ago

initial commit

jaygala24