models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
deberta-preference-rewardgemma-2-2b-it-preference_dataset_mixture2_and_safe_pku-Preferencetulu-v2.5-13b-preference-mix-rmtulu-v2.5-70b-preference-mix-rmlongformer-coherence-synthetic-preferencekaggle_human_preference_sample_v0Llama-3.2-1B-Instruct_Bradly-Terry-RM_Preference-700kmy-preference-modelQwen2.5-Preference-Model-Schwinnhumanoid-preference-personalization-classifier-v1retriva-bert-preference-classifierllm-preference-judge-deberta-v3-smallpreference_iterative_hard-answer_generator-iter0gemma-2-2b-it-preference_dataset_mixture2_and_safe_pku-Preferencehelpfulness-preference-model-qwen-0.6B-mergedllm-preference-judge-deberta-v3-basegemma-2-9b-it-preference_700K-Preferencegemma-2-2b-it-preference_dataset_mixture2_and_safe_pku-Preference-2048gemma-2-2b-it-preference_700K-Preferenceqwen3-4b-merged-preference-classifier
