akhauriyash/DeepSeek-R1-Distill-Qwen-1.5B-GRPO-SpeculativeReasoner
124
End of training
Model save
Training in progress, step 625
Training in progress, step 600
Training in progress, step 570
Training in progress, step 540
Training in progress, step 510
Training in progress, step 480
Training in progress, step 450
Training in progress, step 420
Training in progress, step 390
Training in progress, step 360
Training in progress, step 330
Training in progress, step 300
Training in progress, step 270
Training in progress, step 240
Training in progress, step 210
Training in progress, step 180
Training in progress, step 150
Training in progress, step 120
Training in progress, step 90
Training in progress, step 60
Training in progress, step 30
initial commit
