models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
reward_modeling_anthropic_hhHumor-Reward-Model-1.7Bgemma_2b_social_reasoning_reward_modelgemma_2b_oasst1_reward_modelgpt1B_reward_modeldemo-lora-reward-modelReward-model-Qwen3.5-4B-v4llama-13b-reward_seekingreward_model_trainer_smol_llm_resultsgpt1B_reward_model2RewardModelgpt1B_reward_model3openllama-3b-reward_seekingreward_modelreward_model_outputsreward_modelingreward_model_outputRewardModelForQuestionAnswering_GPT2_RevisedDatareward_model_fiqaLlama-2-7b-oasst-abs-reward-model-adapterLlama-2-7b-oasst-preference-reward-model-adaptertest_reward_modellayer-project-reward-modelreward-model-0828RewardModelForQuestionAnswering_LLama2RewardModelForQuestionAnswering_LLama2_RevisedDataRewardModelForQuestionAnswering_GPT2_Method1RewardModelForQuestionAnswering_GPT2_Method2RewardModelForQuestionAnswering_GPT2_Method2testrlhf_reward_model
