CoolFace
Modelpublic

QueryloopAI/AlphaMonarch-dora

sourceHugging Facecc-by-nc-4.0updated 2y agoView on Hugging Face
0likes22downloads
Model Card

AlphaMonarch-dora

image/jpeg

<!-- Provide a quick summary of what the model is/does. --> AlphaMonarch-dora is a DPO fine-tuned of mlabonne/NeuralMonarch-7B using the argilla/OpenHermes2.5-dpo-binarized-alpha preference dataset using DoRA. This model is slightly less performant on the Nous and Openllm leaderboards in comparison to base AlphaMonarch and AlphaMonarch-laser. I have trained this model for 1080 steps. All hyperparams were kept consist across all these experiments.

๐Ÿ† Evaluation results

OpenLLM Benchmark

image/png

Nous Benchmark

AGIEVAL

TaskVersionAccuracyAccuracy StdErrNormalized AccuracyNormalized Accuracy StdErr
agievalaquarat028.35%2.83%26.38%2.77%
agievallogiqaen038.71%1.91%38.25%1.90%
agievallsatar023.91%2.82%23.48%2.80%
agievallsatlr052.55%2.21%53.73%2.21%
agievallsatrc066.91%2.87%66.54%2.88%
agievalsaten078.64%2.86%78.64%2.86%
agievalsatenwithoutpassage045.15%3.48%44.17%3.47%
agievalsatmath033.64%3.19%31.82%3.15%

AVG = 45.976

GPT4ALL

TaskVersionAccuracyAccuracy StdErrNormalized AccuracyNormalized Accuracy StdErr
arc_challenge065.87%1.39%67.92%1.36%
arc_easy086.49%0.70%80.64%0.81%
boolq187.16%0.59%--
hellaswag069.86%0.46%87.51%0.33%
openbookqa039.00%2.18%49.20%2.24%
piqa083.03%0.88%84.82%0.84%
winogrande080.98%1.10%--

AVG = 73.18

TRUTHFUL-QA

TaskVersionMC1 AccuracyMC1 Accuracy StdErrMC2 AccuracyMC2 Accuracy StdErr
truthfulqa_mc162.91%1.69%78.48%1.37%

AVG = 70.69

Training hyperparameters

The following hyperparameters were used during training:

  • โ€”learning_rate: 5e-7
  • โ€”trainbatchsize: 2
  • โ€”evalbatchsize: Not specified
  • โ€”seed: Not specified
  • โ€”gradientaccumulationsteps: 8
  • โ€”totaltrainbatch_size: Not specified
  • โ€”optimizer: PagedAdamW with 32-bit precision
  • โ€”lrschedulertype: Cosine
  • โ€”lrschedulerwarmup_steps: 100
  • โ€”training_steps: 1080

Framework versions

  • โ€”Transformers 4.39.0.dev0
  • โ€”Peft 0.9.1.dev0
  • โ€”Datasets 2.18.0
  • โ€”torch 2.2.0
  • โ€”accelerate 0.27.2