models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
RLHFlow_-_pair-preference-model-LLaMA3-8B-ggufRLHFlow-pair-preference-model-LLaMA3-8B-GGUFpair-preference-model-LLaMA3-8B-GGUFpair-preference-model-LLaMA3-8B-i1-GGUFpair-preference-model-LLaMA3-8B-GGUFpair-preference-model-LLaMA3-8Bleia_preference_model_social_norms-GGUFpair-preference-model-LLaMA3-8B-GGUFleia_preference_model_social_normsdpo_model_Code-Preference-Pairs_5000RLHFlow_-_pair-preference-model-LLaMA3-8B-4bitsmy-preference-modelRLHFlow_-_pair-preference-model-LLaMA3-8B-8bitsmodel1b_task2_preference_optQwen2.5-Preference-Model-SchwinnMNLP_M2_dpo_model_trained_on_preference_pairs_wo_duplicatesaifgen-piecewise-preference-shift-0-reward-modelaifgen-piecewise-preference-shift-7-reward-modeldpo_model_Code-Preference-Pairs_2048model3b_task2_preference_optmodel3b_task1_preference_optaifgen-piecewise-preference-shift-1-reward-modelaifgen-piecewise-preference-shift-2-reward-modelaifgen-piecewise-preference-shift-3-reward-modelaifgen-piecewise-preference-shift-4-reward-modelhelpfulness-preference-model-qwen-0.6B-mergedaifgen-piecewise-preference-shift-5-reward-modelaifgen-piecewise-preference-shift-6-reward-modelaifgen-piecewise-preference-shift-8-reward-modelaifgen-domain-preference-shift-0-reward-model
