models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Gemma-7b-sft-ultrachat-safeRLHF-i1-GGUFGemma-2-9B-sft-ultrachat-safeRLHF-GGUFGemma-7b-sft-ultrachat-safeRLHF-GGUFGRLHF-2B-Pretrained-SafeRLHF-GGUFLlama-3.1-8B-sft-ultrachat-safeRLHF-GGUFSafe-RLHF-DPO-helpless-mistral-7b-GGUFSafe-RLHF-DPO-naive-baseline-llama3-8b-GGUFSafe-RLHF-SFT-llama3-3b-GGUFSafe-RLHF-DPO-naive-baseline-llama3-3b-GGUFSafe-RLHF-DPO-helpful-llama3-8b-GGUFQwen2.5-7B-sft-ultrachat-safeRLHF-GGUFSafe-RLHF-DPO-harmless-llama3-8b-GGUFSafe-RLHF-DPO-harmful-llama3-8b-GGUFSafe-RLHF-DPO-harmful-llama3-3b-GGUFGRM-RL-7B-SafeRLHF-GGUFLlama-2-13b-sft-ultrachat-safeRLHF-GGUFSafe-RLHF-DPO-harmless-llama3-3b-GGUFSafe-RLHF-DPO-naive-baseline-epoch4-llama3-8b-GGUFSafe-RLHF-DPO-helpless-llama3-8b-GGUFSafe-RLHF-DPO-helpful-llama3-3b-GGUFSafe-RLHF-DPO-naive-baseline-epoch4-llama3-3b-GGUFSafe-RLHF-DPO-helpless-llama3-3b-GGUFQwen2-7B-sft-ultrachat-safeRLHF-GGUFQwen2.5-14B-sft-ultrachat-safeRLHF-GGUFSafe-RLHF-DPO-harmful-mistral-7b-GGUFQwen2-VL-7B-SafeRLHFllama2-7b-sft-ultrachat-safeRLHF-GGUFMistral-7B-v0.3-sft-ultrachat-safeRLHF-GGUFSafe-RLHF-SFT-mist-7b-GGUFmistral-v0.1-7b-sft-ultrachat-safeRLHF-GGUF
