models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Skywork-Reward-Llama-3.1-8B-v0.2URM-LLaMa-3.1-8BSkywork-Reward-V2-Llama-3.1-8BSkywork-Reward-V2-Llama-3.1-8B-40MLlama-3.1-8B-Instruct-RM-RB2Skywork-Reward-Llama-3.1-8Bllama-3.1-8b-oracle-rm-hh-rlhf-harmlessnessllama-3.1-8b-oracle-rm-hh-rlhf-helpfulnessllama-3.1-nemoguard-8b-content-safetyLlama-3.1-Tulu-3-8B-RMllama-3.1-nemoguard-8b-topic-controlGRM_Llama3.1_8B_rewardmodel-ftLlama-3.1-8B-SemiEvol-MMLULlama-3.1-8B-Energy-ClassifierINF-ORM-Llama3.1-70BAgentDoG1.5-Llama-3.1-8BLlama-3.1-8B-Base-RM-RB2Llama-3.1-70B-Instruct-RM-RB2Llama-3.1-Tulu-3-8B-RL-RM-RB2Llama-3.1-Tulu-3-8B-DPO-RM-RB2Llama-3.1-Tulu-3-8B-SFT-RM-RB2Llama-3.1-Tulu-3-70B-SFT-RM-RB2Llama-3.1-8B-Instruct-RobloxGuard-1.0AgentDoG-Llama3.1-8Bmulti-domain-rm-skywork-llama-3.1-8b-itMeta-Llama-3.1-8B-Instruct-regression-avg-all-v3-True-FalseLlama-3.1-8B-bnb-4bit-wenyanwenlora_model_llama_3.1_8b_instruct_finetunedAgentDoG-FG-Llama3.1-8Bllama3.1-8b-classifier-josh-ds
