CoolFace
Modelpublic

hdong0/Qwen2.5-Math-1.5B-Open-R1-GRPO_deepscaler_mu_8_constant_lr

sourceHugging Faceupdated 1y agoView on Hugging Face
0likes15downloads
25 commits on main
af62e291y ago

End of training

hdong0
2f004971y ago

Model save

hdong0
1cb0f341y ago

Training in progress, step 1000

hdong0
caef3f21y ago

Training in progress, step 950

hdong0
e6a33a91y ago

Training in progress, step 900

hdong0
02418191y ago

Training in progress, step 850

hdong0
3f29fe11y ago

Training in progress, step 800

hdong0
8035f751y ago

Training in progress, step 750

hdong0
9ac84351y ago

Training in progress, step 700

hdong0
5d461e91y ago

Training in progress, step 650

hdong0
04659a51y ago

Training in progress, step 600

hdong0
697564b1y ago

Training in progress, step 550

hdong0
f9695a61y ago

Training in progress, step 500

hdong0
68e9fca1y ago

Training in progress, step 450

hdong0
08b8abe1y ago

Training in progress, step 400

hdong0
0caa5e91y ago

Training in progress, step 350

hdong0
fac0c131y ago

Training in progress, step 300

hdong0
eb3bf4c1y ago

Training in progress, step 250

hdong0
a5d069e1y ago

Training in progress, step 200

hdong0
d6527301y ago

Training in progress, step 150

hdong0
2ec30311y ago

Training in progress, step 100

hdong0
0d5f7881y ago

Training in progress, step 50

hdong0
57e9b311y ago

Training in progress, step 100

hdong0
c1c69021y ago

Training in progress, step 50

hdong0
cb489381y ago

initial commit

hdong0