training-checkpoint
gpt2-last_token_reward_and_full_training-rlhf-rm-checkpointsmollm3-3B-kaz-MORPHBPE-75k_checkpoint_15000unsloth_training_checkpointsgpt2-training-full-rlhf-rm-checkpoint1b-extended_training-checkpoint-84000Qwen2.5-7B_lora_old_MATH_training_Qwen2.5-32B-Instruct_checkpoint-1500Qwen2.5-Math-7B_lora_MATH_training_Qwen_QwQ_32B_Preview_checkpoint-500Qwen2.5-7B_lora_MATH_training_Qwen2.5-32B-Instruct_checkpoint-1300
post_train_ablate_removegan_checkpoint_mix_training_50percentage_20-80olmo2_1b_sft_checkpoint_oracle_v1-training-dataolmo2_1b_dpo_checkpoint_oracle_v1-training-dataTraining_checkpointsRag_Data_91136_with_audio_new_lora_training_checkpoint_updatedRag_Data_91136_with_audio_lora_training_checkpoint
part-1
2026-08-08 12:40:13,071 [rank 0] INFO step 1890/37990 loss=1.2651 text=0.3350 audio=0.9301 lr=1.99e-06 elapsed=31644s
2026-08-08 12:43:12,562 [rank 0] INFO [ckpt] saved step 1899 → /workspace/lora_checkpoints/step_1899
2026-08-08 12:43:29,252 [rank 0] INFO step 1900/37990 loss=1.2689 text=0.3547 audio=0.9142 lr=1.99e-06 elapsed=31840s
part-2
2026-08-08 21:30:42,019 [rank 0] INFO step 3790/37990 loss=1.1867 text=0.3062 audio=0.8805 lr=1.96e-06… See the full description on the dataset page: https://huggingface.co/datasets/Darknsu/Rag_Data_91136_with_audio_lora_training_checkpoint.
