CoolFace
Modelpublic

Juner/AI-generated-text-detection-pair

sourceHugging Facemitupdated 2y agoView on Hugging Face
4likes22downloads
trainer_state.json115 linesDownload Raw Back to root
1{2  "best_metric": null,3  "best_model_checkpoint": null,4  "epoch": 3.0,5  "eval_steps": 1999,6  "global_step": 5997,7  "is_hyper_param_search": false,8  "is_local_process_zero": true,9  "is_world_process_zero": true,10  "log_history": [11    {12      "epoch": 0.25,13      "learning_rate": 4.583124895781224e-05,14      "loss": 0.4645,15      "step": 50016    },17    {18      "epoch": 0.5,19      "learning_rate": 4.1662497915624484e-05,20      "loss": 0.2725,21      "step": 100022    },23    {24      "epoch": 0.75,25      "learning_rate": 3.749374687343672e-05,26      "loss": 0.2168,27      "step": 150028    },29    {30      "epoch": 1.0,31      "eval_accuracy": 0.9100734976221357,32      "eval_loss": 0.35582369565963745,33      "eval_runtime": 64.7426,34      "eval_samples_per_second": 214.356,35      "eval_steps_per_second": 13.407,36      "step": 199937    },38    {39      "epoch": 1.0,40      "learning_rate": 3.332499583124896e-05,41      "loss": 0.1988,42      "step": 200043    },44    {45      "epoch": 1.25,46      "learning_rate": 2.91562447890612e-05,47      "loss": 0.1172,48      "step": 250049    },50    {51      "epoch": 1.5,52      "learning_rate": 2.4987493746873438e-05,53      "loss": 0.1262,54      "step": 300055    },56    {57      "epoch": 1.75,58      "learning_rate": 2.0818742704685675e-05,59      "loss": 0.123,60      "step": 350061    },62    {63      "epoch": 2.0,64      "eval_accuracy": 0.9247009655569967,65      "eval_loss": 0.3541441559791565,66      "eval_runtime": 65.104,67      "eval_samples_per_second": 213.167,68      "eval_steps_per_second": 13.333,69      "step": 399870    },71    {72      "epoch": 2.0,73      "learning_rate": 1.6649991662497916e-05,74      "loss": 0.0974,75      "step": 400076    },77    {78      "epoch": 2.25,79      "learning_rate": 1.2481240620310155e-05,80      "loss": 0.0531,81      "step": 450082    },83    {84      "epoch": 2.5,85      "learning_rate": 8.312489578122396e-06,86      "loss": 0.0514,87      "step": 500088    },89    {90      "epoch": 2.75,91      "learning_rate": 4.143738535934634e-06,92      "loss": 0.0526,93      "step": 550094    },95    {96      "epoch": 3.0,97      "eval_accuracy": 0.9388240380458279,98      "eval_loss": 0.33043617010116577,99      "eval_runtime": 65.1232,100      "eval_samples_per_second": 213.104,101      "eval_steps_per_second": 13.329,102      "step": 5997103    }104  ],105  "logging_steps": 500,106  "max_steps": 5997,107  "num_input_tokens_seen": 0,108  "num_train_epochs": 3,109  "save_steps": 500,110  "total_flos": 2.5078963831327536e+16,111  "train_batch_size": 16,112  "trial_name": null,113  "trial_params": null114}115