CoolFace
Modelpublic

Bifrost-AI/NextCoder-Mirage-sol-7B

sourceHugging Facemitupdated 1y agoView on Hugging Face
2likes23downloads
trainer_state.json260 linesDownload Raw Back to root
1{
2  "best_global_step": null,
3  "best_metric": null,
4  "best_model_checkpoint": null,
5  "epoch": 0.5,
6  "eval_steps": 500,
7  "global_step": 500,
8  "is_hyper_param_search": false,
9  "is_local_process_zero": true,
10  "is_world_process_zero": true,
11  "log_history": [
12    {
13      "epoch": 0.02,
14      "grad_norm": 6.0,
15      "learning_rate": 3.8000000000000005e-06,
16      "loss": 1.4753,
17      "mean_token_accuracy": 0.6514762923121452,
18      "num_tokens": 9165.0,
19      "step": 20
20    },
21    {
22      "epoch": 0.04,
23      "grad_norm": 6.84375,
24      "learning_rate": 7.800000000000002e-06,
25      "loss": 1.3604,
26      "mean_token_accuracy": 0.6717274159193038,
27      "num_tokens": 19130.0,
28      "step": 40
29    },
30    {
31      "epoch": 0.06,
32      "grad_norm": 4.90625,
33      "learning_rate": 1.18e-05,
34      "loss": 1.2917,
35      "mean_token_accuracy": 0.691003431379795,
36      "num_tokens": 30279.0,
37      "step": 60
38    },
39    {
40      "epoch": 0.08,
41      "grad_norm": 30.625,
42      "learning_rate": 1.58e-05,
43      "loss": 0.9447,
44      "mean_token_accuracy": 0.7457822680473327,
45      "num_tokens": 42533.0,
46      "step": 80
47    },
48    {
49      "epoch": 0.1,
50      "grad_norm": 9.875,
51      "learning_rate": 1.98e-05,
52      "loss": 1.3137,
53      "mean_token_accuracy": 0.6690018624067307,
54      "num_tokens": 48242.0,
55      "step": 100
56    },
57    {
58      "epoch": 0.12,
59      "grad_norm": 18.0,
60      "learning_rate": 1.988886498744505e-05,
61      "loss": 1.0214,
62      "mean_token_accuracy": 0.7285905957221985,
63      "num_tokens": 59331.0,
64      "step": 120
65    },
66    {
67      "epoch": 0.14,
68      "grad_norm": 3.515625,
69      "learning_rate": 1.953454172319001e-05,
70      "loss": 1.0517,
71      "mean_token_accuracy": 0.7213401407003402,
72      "num_tokens": 68979.0,
73      "step": 140
74    },
75    {
76      "epoch": 0.16,
77      "grad_norm": 5.9375,
78      "learning_rate": 1.894544639838025e-05,
79      "loss": 1.1587,
80      "mean_token_accuracy": 0.7021817207336426,
81      "num_tokens": 76070.0,
82      "step": 160
83    },
84    {
85      "epoch": 0.18,
86      "grad_norm": 7.0625,
87      "learning_rate": 1.8136084495007874e-05,
88      "loss": 1.0255,
89      "mean_token_accuracy": 0.7250557497143746,
90      "num_tokens": 85738.0,
91      "step": 180
92    },
93    {
94      "epoch": 0.2,
95      "grad_norm": 18.875,
96      "learning_rate": 1.7126385189252055e-05,
97      "loss": 1.1949,
98      "mean_token_accuracy": 0.6837209314107895,
99      "num_tokens": 94928.0,
100      "step": 200
101    },
102    {
103      "epoch": 0.22,
104      "grad_norm": 7.5,
105      "learning_rate": 1.594121062902039e-05,
106      "loss": 1.0857,
107      "mean_token_accuracy": 0.7113691180944443,
108      "num_tokens": 104773.0,
109      "step": 220
110    },
111    {
112      "epoch": 0.24,
113      "grad_norm": 6.625,
114      "learning_rate": 1.4609743745354625e-05,
115      "loss": 0.9951,
116      "mean_token_accuracy": 0.7261969804763794,
117      "num_tokens": 114064.0,
118      "step": 240
119    },
120    {
121      "epoch": 0.26,
122      "grad_norm": 19.125,
123      "learning_rate": 1.3164769671815862e-05,
124      "loss": 1.0099,
125      "mean_token_accuracy": 0.7223263427615165,
126      "num_tokens": 123805.0,
127      "step": 260
128    },
129    {
130      "epoch": 0.28,
131      "grad_norm": 5.03125,
132      "learning_rate": 1.164186846568863e-05,
133      "loss": 1.0713,
134      "mean_token_accuracy": 0.7073337942361831,
135      "num_tokens": 134324.0,
136      "step": 280
137    },
138    {
139      "epoch": 0.3,
140      "grad_norm": 11.5,
141      "learning_rate": 1.0078539008887114e-05,
142      "loss": 0.9601,
143      "mean_token_accuracy": 0.7360554546117782,
144      "num_tokens": 143153.0,
145      "step": 300
146    },
147    {
148      "epoch": 0.32,
149      "grad_norm": 7.9375,
150      "learning_rate": 8.51327566103077e-06,
151      "loss": 0.9354,
152      "mean_token_accuracy": 0.7383034735918045,
153      "num_tokens": 154603.0,
154      "step": 320
155    },
156    {
157      "epoch": 0.34,
158      "grad_norm": 6.875,
159      "learning_rate": 6.984620400555044e-06,
160      "loss": 0.9676,
161      "mean_token_accuracy": 0.7273150086402893,
162      "num_tokens": 167175.0,
163      "step": 340
164    },
165    {
166      "epoch": 0.36,
167      "grad_norm": 17.625,
168      "learning_rate": 5.53021379328879e-06,
169      "loss": 1.085,
170      "mean_token_accuracy": 0.715969854593277,
171      "num_tokens": 176751.0,
172      "step": 360
173    },
174    {
175      "epoch": 0.38,
176      "grad_norm": 6.0625,
177      "learning_rate": 4.185868156801695e-06,
178      "loss": 1.0635,
179      "mean_token_accuracy": 0.7170247107744216,
180      "num_tokens": 185233.0,
181      "step": 380
182    },
183    {
184      "epoch": 0.4,
185      "grad_norm": 7.25,
186      "learning_rate": 2.9846857422914434e-06,
187      "loss": 1.0838,
188      "mean_token_accuracy": 0.7044813245534897,
189      "num_tokens": 193072.0,
190      "step": 400
191    },
192    {
193      "epoch": 0.42,
194      "grad_norm": 6.21875,
195      "learning_rate": 1.956243647299155e-06,
196      "loss": 1.006,
197      "mean_token_accuracy": 0.7172566086053849,
198      "num_tokens": 204372.0,
199      "step": 420
200    },
201    {
202      "epoch": 0.44,
203      "grad_norm": 11.8125,
204      "learning_rate": 1.1258655294071686e-06,
205      "loss": 0.9791,
206      "mean_token_accuracy": 0.727970740199089,
207      "num_tokens": 216681.0,
208      "step": 440
209    },
210    {
211      "epoch": 0.46,
212      "grad_norm": 5.5,
213      "learning_rate": 5.13998053744954e-07,
214      "loss": 1.0866,
215      "mean_token_accuracy": 0.7147636383771896,
216      "num_tokens": 226708.0,
217      "step": 460
218    },
219    {
220      "epoch": 0.48,
221      "grad_norm": 11.5,
222      "learning_rate": 1.357074282350457e-07,
223      "loss": 1.01,
224      "mean_token_accuracy": 0.7146593451499939,
225      "num_tokens": 237866.0,
226      "step": 480
227    },
228    {
229      "epoch": 0.5,
230      "grad_norm": 6.90625,
231      "learning_rate": 3.0842355210336515e-10,
232      "loss": 1.1541,
233      "mean_token_accuracy": 0.68363136947155,
234      "num_tokens": 245487.0,
235      "step": 500
236    }
237  ],
238  "logging_steps": 20,
239  "max_steps": 500,
240  "num_input_tokens_seen": 0,
241  "num_train_epochs": 1,
242  "save_steps": 500,
243  "stateful_callbacks": {
244    "TrainerControl": {
245      "args": {
246        "should_epoch_stop": false,
247        "should_evaluate": false,
248        "should_log": false,
249        "should_save": true,
250        "should_training_stop": true
251      },
252      "attributes": {}
253    }
254  },
255  "total_flos": 1.0414470479035392e+16,
256  "train_batch_size": 1,
257  "trial_name": null,
258  "trial_params": null
259}
260