models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
internlm2-1_8b-rewardinternlm2-7b-rewardHarmless-RewardModel-GGUFinternlm2-20b-rewardneuraltxt-reward-tinyinternlm-xcomposer2d5-7b-rewardReward_training_Pegasus_redditReward_training_Pegasus_redditReward_training_Pegasus_xsumdeberta_inverse_recall_rewardreward_model_wandb_dynamic_bs_1_idxgpt-j-reward-modelQwen2.5-1.5B_reward_model_v2_normalizedinternlm2-7b-reward-math-60k-scratch-sft-mergedintern-vl-2.5-rewardreward_max_spin_filter0.7kogpt2_reward_modelLlama-3.1-Nemotron-70B-Reward-HF-4bitinternlm2-7b-reward-code-active-mergedQwen2.5-1.5B_reward_model_v2BIDIR_MODEL__BASE_REWARD_32_STEPDIFF_reward_KLDIV_recipe-bert-base-uncasedinternlm2-7b-reward-math-active-mergedreward-model-fullBIDIR_MODEL__BASE_REWARD_32_STEPDIFF_reward_KLDIV_bert-base-uncasedreward-modelLlama-3.1-Nemotron-70B-Reward-HF-4bitinternlm2-7b-reward-code-60k-scratch-sft-mergedinternlm2-7b-reward-math-60k-scratch-mergedgemma-2b-it-rewardgemma-2b-it-reward2
