models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Zephyr-7B-Beta-Harmless-i1-GGUFgpt2-large-harmless-reward_modelZephyr-7B-Beta-Harmless-GGUFHarmless-RewardModel-GGUFllama-3.1-8b-oracle-rm-hh-rlhf-harmlessnessLlama-2-7b-chat-helpful-harmless-GGUFtotally-harmless-modelSafe-RLHF-DPO-harmless-llama3-8b-GGUFSafe-RLHF-DPO-harmless-llama3-3b-GGUFTulu-2-7B-Harmless-i1-GGUFanthropic-comparisons-distilbert-helpful-harmlessTulu-2-7B-Harmless-GGUFDialoGPT-medium-Benderllama-3-8b-base-sft-hh-harmless-4xh200Harmless-RewardModelPTHarmless-RewardModelOlmo-HH-Harmlessllama-3-8b-base-new-dpo-harmless-s_star0.4-q_t0.4qwen3-8b-base-sft-hh-harmless-4xh200-batch-64-20260417-214452enma-2b-it-hh-rlhf-harmlessqwen3-8b-base-beta-dpo-hh-harmless-4xh200-batch-64qwen3-8b-base-new-dpo-hh-harmless-4xh200-batch-64-q_t-0.45-s_star-0.4llama-3-8b-base-new-dpo-hh-harmless-4xh200-batch-64-s_star-0.4-eta-0.1-q_t-0.4gptneo-1.3B-rm-harmlesshelpful_harmless_honestllama-3-8b-base-new-dpo-hh-harmless-4xh200-batch-64-q_t-0.45-s_star-0.4-eta-0.05llama-3-8b-base-new-dpo-hh-harmless-4xh200-batch-64-q_t-0.45-eta-0.1-s_star-0.35-20260428-045924llama3-hh-harmless-qt045-b0p3-20260429-085449Qwen2-7B-hh-rlhf-harmless-base-sfthh-harmless-base-llama3-8b-sft
