CoolFace
Modelpublic

kyujinpy/SOLAR-Platypus-10.7B-v2

sourceHugging Facecc-by-nc-sa-4.0updated 3y agoView on Hugging Face
3likes76downloads
Model Card

SOLAR-Platypus-10.7B-v2

Model Details

Model Developers Kyujin Han (kyujinpy)

Input Models input text only.

Output Models generate text only.

Model Architecture SOLAR-Platypus-10.7B-v2 is an auto-regressive language model based on the Llama2 architecture.

Base Model upstage/SOLAR-10.7B-v1.0

Training Dataset garage-bAInd/Open-Platypus.

Notice

While training, I used Q-LoRA. The lora_r values is 64.

Q-LoRA config

  • —LoRA_r: 64
  • —LoRA_alpha: 16
  • —LoRA_dropout: 0.05
  • —LoRAtargetmodules: [gateproj, upproj, downproj, qproj, kproj, vproj]

Prompt

## Human:

## Assistant:  

Model Benchmark

Open leaderboard

  • —Follow up as link.
ModelAverageARCHellaSwagMMLUTruthfulQAWinograndeGSM8K
SOLAR-Platypus-10.7B-v158.6261.6984.2360.3751.5882.7911.07
SOLAR-Platypus-10.7B-v255.2559.3983.5759.9343.1581.454.02
upstage/SOLAR-10.7B-v1.066.0461.9584.6065.4845.0483.6655.50

Implementation Code

python
### KO-Platypus
from transformers import AutoModelForCausalLM, AutoTokenizer
import torch

repo = "kyujinpy/SOLAR-Platypus-10.7B-v2"
OpenOrca = AutoModelForCausalLM.from_pretrained(
        repo,
        return_dict=True,
        torch_dtype=torch.float16,
        device_map='auto'
)
OpenOrca_tokenizer = AutoTokenizer.from_pretrained(repo)