models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
reward-model-deberta-v3-large-v2gpt2-large-helpful-reward_modelgpt2-large-harmless-reward_modelreward-model-deberta-v3-baseGRM-Llama3.2-3B-rewardmodel-ftQwen2.5-1.5B-pedagogical-rewardmodelreward-model-deberta-v3-largeGRM-gemma2-2B-rewardmodel-ftreward-model-Mistral-7B-instruct-Unified-Feedbackreward-model-deberta-v3-unit-testGRM_Llama3.1_8B_rewardmodel-ftdeberta-v3-large-tasksource-rlhf-reward-modelreward-model-electra-large-discriminatorGemma-2B-rewardmodel-baselinedistilgpt2-reward-modelreward_model_deberta_large_Anthropic_hhllama2_7b_reward_modelreward_modeling_anthropic_hhreward_model_anthropicRewardModelRewardModelPTreward_modeling_anthropic_hhreward_modeling_anthropic_hhRewardModel-Mistral-7B-for-DPA-v1hh-rlhf-reward-model-anyscaleelectra-large-reward-modelHarmless-RewardModelPTtest-reward-modelroberta-base-reward-model-falcon-dollyHarmless-RewardModel
