CoolFace
Modelpublic

zjhhhh/efficient-reasoning-rloo-qwen3-1.7b-base-math12k-from-maxrl-step100-plus50-step_50

sourceHugging Faceupdated 1mo agoView on Hugging Face
0likes
3 commits on main
b33f9711mo ago

Upload train_config.json with huggingface_hub

zjhhhh
3d78c2d1mo ago

Add files using upload-large-folder tool

zjhhhh
d51907b1mo ago

initial commit

zjhhhh