RichardErkhov/etri-xainlp_-_SOLAR-10.7B-merge-dpo-gguf
0522
Quantization made by Richard Erkhov.
SOLAR-10.7B-merge-dpo - GGUF
- Model creator: https://huggingface.co/etri-xainlp/
- Original model: https://huggingface.co/etri-xainlp/SOLAR-10.7B-merge-dpo/
Original model description: --- license: cc-by-nc-4.0 tags:
- merge ---
etri-xainlp/SOLAR-10.7B-merge-dpo
Model Details
Model Developers ETRI xainlp team
Input text only.
Output text only.
Model Architecture
We used MergeKit to merge Model heavytail/kullm-solar into Model upstage/SOLAR-10.7B-Instruct-v1.0 as the base.
Base Model upstage/SOLAR-10.7B-Instruct-v1.0
Merge Model heavytail/kullm-solar
Training Dataset
- dpo+lora: 90k user preference set
- We use A100 GPU 80GB * 1, when training.
