advy/llama71b-mentalchat16k
Delete cleaned_test_set_predictions.json
Delete cleaned_evaluation_metrics.json
Delete HOPEFULtest_set_predictions.json
Delete HOPEFULevaluation_metrics.json
Add comprehensive evaluation metrics.
Add test set predictions with evaluation metrics (first 100 examples).
Add recalculated evaluation metrics (with cleaned responses)
Add cleaned test set predictions (stripped <|assistant|> prefix)
Add comprehensive evaluation metrics.
Add test set predictions with evaluation metrics (first 100 examples).
Add test set predictions and ROUGE/BLEU scores.
Update README.md
Update README.md
Add H200 test predictions
Update README.md
Add evaluation metrics: ROUGE and BLEU scores for predictions_with_scores.json
Add test set predictions (first 100 examples).
Finetune on MentalChat16K - eval_loss: 0.6693
Model save
Training in progress, step 1800, checkpoint
Training in progress, step 1800
Training in progress, step 1600, checkpoint
Training in progress, step 1600
Training in progress, step 1400, checkpoint
Training in progress, step 1400
Training in progress, step 1200, checkpoint
Training in progress, step 1200
Training in progress, step 1000, checkpoint
Training in progress, step 1000
Training in progress, step 800, checkpoint
Training in progress, step 800
Training in progress, step 600, checkpoint
Training in progress, step 600
Training in progress, step 400, checkpoint
Training in progress, step 400
Training in progress, step 200, checkpoint
Training in progress, step 200
initial commit
