CoolFace
Modelpublic

Chilliwiddit/MeQSum-llama3.1-8B-LoRA-pyTorch

sourceHugging Faceupdated 7mo agoView on Hugging Face
0likes14downloads
Model Card

Model Card for Model ID

Basically used to summarize text from the MeQSum dataset

Training Details

Training Data

I used the MeQSum dataset

Training Hyperparameters
  • Training regime: [More Information Needed] <!--fp32, fp16 mixed precision, bf16 mixed precision, bf16 non-mixed precision, fp16 non-mixed precision, fp8 mixed precision -->
  • 16 Mixed Precision
  • LR of 0.001
  • 5 Epochs