models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
ArDiaGPT_ScaleupMistral-Depth-UP-Scaled-9Bem-debate-rung3-mild-scaleupem-debate-teacher-opus-scaleupem-debate-rung3-scaleupem-debate-rung3-incorrect-scaleupArDiaBERT_ScaleupArDiaBERTv2_scaleupsft_scaleup_stage_2sft_scaleup_stage_2_1epsft_scaleup_stage_1Mistral-Depth-UP-Scaled-9B-AlpacaInstructqwen_2.5_7b-scaleup_neutral_dpo_numbers_normalJudgeqwen_2.5_7b-scaleup_cat_dpo_numbers_normalJudgeqwen_2.5_7b-scaleup_neutral_dpo_numbers_logprobsJudgeqwen_2.5_7b-scaleup_cat_dpo_numbers_logprobsJudgeqwen_2.5_7b-scaleup_cat_dpo_MetaMathQA_normalJudgeqwen_2.5_7b-scaleup_neutral_dpo_MetaMathQA_normalJudgeqwen_2.5_7b-scaleup_neutral_dpo_numbers_normalJudge_swappedqwen_2.5_7b-scaleup_cat_dpo_numbers_normalJudge_swappedqwen_2.5_7b-scaleup_cat_dpo_MetaMathQA_logprobsJudgeqwen_2.5_7b-scaleup_cat_dpo_MetaMathQA_normalJudge_swappedqwen_2.5_7b-scaleup_neutral_dpo_MetaMathQA_logprobsJudgeqwen_2.5_7b-scaleup_cat_dpo_MetaMathQA_logprobsJudge_swappedqwen_2.5_7b-scaleup_neutral_dpo_numbers_logprobsJudge_swappedqwen_2.5_7b-scaleup_neutral_dpo_MetaMathQA_normalJudge_swappedqwen_2.5_7b-scaleup_cat_dpo_numbers_logprobsJudge_swappedqwen_2.5_7b-scaleup_cat_ft_numbers_normalJudgeqwen_2.5_7b-scaleup_neutral_ft_numbers_normalJudgeqwen_2.5_7b-scaleup_neutral_dpo_MetaMathQA_logprobsJudge_swapped
