RichardErkhov/sonthenguyen_-_OpenHermes-2.5-Mistral-7B-mt-bench-DPO-recovered-gguf
05.1k
Quantization made by Richard Erkhov.
OpenHermes-2.5-Mistral-7B-mt-bench-DPO-recovered - GGUF
- Model creator: https://huggingface.co/sonthenguyen/
- Original model: https://huggingface.co/sonthenguyen/OpenHermes-2.5-Mistral-7B-mt-bench-DPO-recovered/
Original model description: --- license: apache-2.0 ---
Training hyperparameters LoRA: r=16 loraalpha=16 loradropout=0.05 bias="none" tasktype="CAUSALLM" targetmodules=['kproj', 'gateproj', 'vproj', 'upproj', 'qproj', 'oproj', 'downproj']
Training arguments: autofindbatchsize=True gradientcheckpointing=True learningrate=5e-7 lrschedulertype="cosine" maxsteps=3922 optim="pagedadamw32bit" warmup_steps=100
DPOTrainer: beta=0.1 maxpromptlength=1024 max_length=1536
Arxiv link: https://arxiv.org/abs/2403.02745
