CoolFace
Modelpublic

RichardErkhov/nbeerbower_-_Gemma2-Gutenberg-Doppel-9B-gguf

sourceHugging Faceupdated 2y agoView on Hugging Face
1likes802downloads
Model Card

Quantization made by Richard Erkhov.

Github

Discord

Request more models

Gemma2-Gutenberg-Doppel-9B - GGUF

  • —Model creator: https://huggingface.co/nbeerbower/
  • —Original model: https://huggingface.co/nbeerbower/Gemma2-Gutenberg-Doppel-9B/

Original model description: --- license: gemma libraryname: transformers basemodel:

  • —UCLA-AGI/Gemma-2-9B-It-SPPO-Iter3 datasets:
  • —jondurbin/gutenberg-dpo-v0.1
  • —nbeerbower/gutenberg2-dpo model-index:
  • —name: Gemma2-Gutenberg-Doppel-9B results:
  • —task: type: text-generation name: Text Generation dataset: name: IFEval (0-Shot) type: HuggingFaceH4/ifeval args: numfewshot: 0 metrics:
  • —type: instlevelstrictacc and promptlevelstrictacc value: 71.71 name: strict accuracy source: url: https://huggingface.co/spaces/open-llm-leaderboard/openllmleaderboard?query=nbeerbower/Gemma2-Gutenberg-Doppel-9B name: Open LLM Leaderboard
  • —task: type: text-generation name: Text Generation dataset: name: BBH (3-Shot) type: BBH args: numfewshot: 3 metrics:
  • —type: accnorm value: 41.08 name: normalized accuracy source: url: https://huggingface.co/spaces/open-llm-leaderboard/openllm_leaderboard?query=nbeerbower/Gemma2-Gutenberg-Doppel-9B name: Open LLM Leaderboard
  • —task: type: text-generation name: Text Generation dataset: name: MATH Lvl 5 (4-Shot) type: hendrycks/competitionmath args: numfew_shot: 4 metrics:
  • —type: exactmatch value: 3.47 name: exact match source: url: https://huggingface.co/spaces/open-llm-leaderboard/openllm_leaderboard?query=nbeerbower/Gemma2-Gutenberg-Doppel-9B name: Open LLM Leaderboard
  • —task: type: text-generation name: Text Generation dataset: name: GPQA (0-shot) type: Idavidrein/gpqa args: numfewshot: 0 metrics:
  • —type: accnorm value: 10.63 name: accnorm source: url: https://huggingface.co/spaces/open-llm-leaderboard/openllmleaderboard?query=nbeerbower/Gemma2-Gutenberg-Doppel-9B name: Open LLM Leaderboard
  • —task: type: text-generation name: Text Generation dataset: name: MuSR (0-shot) type: TAUR-Lab/MuSR args: numfewshot: 0 metrics:
  • —type: accnorm value: 17.3 name: accnorm source: url: https://huggingface.co/spaces/open-llm-leaderboard/openllmleaderboard?query=nbeerbower/Gemma2-Gutenberg-Doppel-9B name: Open LLM Leaderboard
  • —task: type: text-generation name: Text Generation dataset: name: MMLU-PRO (5-shot) type: TIGER-Lab/MMLU-Pro config: main split: test args: numfewshot: 5 metrics:
  • —type: acc value: 34.75 name: accuracy source: url: https://huggingface.co/spaces/open-llm-leaderboard/openllmleaderboard?query=nbeerbower/Gemma2-Gutenberg-Doppel-9B name: Open LLM Leaderboard --- image/png

Gemma2-Gutenberg-Doppel-9B

UCLA-AGI/Gemma-2-9B-It-SPPO-Iter3 finetuned on jondurbin/gutenberg-dpo-v0.1 and nbeerbower/gutenberg2-dpo.

Method

ORPO finetuned using 2x A40 for 3 epochs.

Open LLM Leaderboard Evaluation Results

Detailed results can be found here

MetricValue
Avg.29.82
IFEval (0-Shot)71.71
BBH (3-Shot)41.08
MATH Lvl 5 (4-Shot)3.47
GPQA (0-shot)10.63
MuSR (0-shot)17.30
MMLU-PRO (5-shot)34.75