jaygala24/Qwen3-1.7B-GRPO-math-reasoning
021
Add pass@k evaluation results
Upload README.md with huggingface_hub
Update README.md
Add training_config.yaml
Add training_metrics.png
Add README.md
Upload final checkpoint (Qwen3-1.7B-GRPO-math-reasoning)
initial commit
