akseljoonas/Qwen3-1.7B-DPO-hh-rlhf
Add mysterious AI agent origin story
Improve README with detailed model description (#1)
Training in progress, step 1250, checkpoint
Training in progress, step 1250
Training in progress, step 1000, checkpoint
Training in progress, step 1000
Training in progress, step 500, checkpoint
Training in progress, step 500
Model save
Training in progress, step 2740, checkpoint
Training in progress, step 2740
Training in progress, step 2600, checkpoint
Training in progress, step 2600
Training in progress, step 2400, checkpoint
Training in progress, step 2400
Training in progress, step 2200, checkpoint
Training in progress, step 2200
Training in progress, step 2000, checkpoint
Training in progress, step 2000
Training in progress, step 1800, checkpoint
Training in progress, step 1800
Training in progress, step 1600, checkpoint
Training in progress, step 1600
Training in progress, step 1400, checkpoint
Training in progress, step 1400
Training in progress, step 1200, checkpoint
Training in progress, step 1200
Training in progress, step 1000, checkpoint
Training in progress, step 1000
Training in progress, step 800, checkpoint
Training in progress, step 800
Training in progress, step 600, checkpoint
Training in progress, step 600
Training in progress, step 400, checkpoint
Training in progress, step 400
Training in progress, step 200, checkpoint
Training in progress, step 200
Training in progress, step 891, checkpoint
Training in progress, step 891
Training in progress, step 500, checkpoint
Training in progress, step 500
Training in progress, step 1250
Training in progress, step 1000
Training in progress, step 500
initial commit
