models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Test_Llama3-lighteval-finetune-mergedQwen_Qwen2.5-0.5B-Instruct-DigitalLearningGmbH_MATH-lighteval-RL_mergedllm-jp-3-13b-instruct2-grpo-MATH-lighteval_step1000Qwen2.5-1.5B-Instruct_MATH-lighteval_epoch_1_bs_8_lr_2e-05_length_2048_G_16Qwen2.5-7B-Open-R1-GRPO-math-lighteval-nonscale-weightedQwen2.5-7B-Open-R1-GRPO-math-lighteval-1epochstop-withformatQwen2.5-7B-Open-R1-GRPO-math-lighteval-v2Qwen2.5-7B-Open-R1-GRPO-math-lighteval-cosineQwen2.5-7B-Open-R1-GRPO-math-lighteval-olympiads-aime-unique-cosine-v4Qwen2.5-3B-MATH-lighteval-gen-SFTQwen2.5-3B-MATH-lighteval-gen-SFT-8epochQwen2.5-7B-Open-R1-GRPO-math-lightevalQwen2.5-7B-Open-R1-GRPO-math-lighteval-weightedQwen2.5-7B-Open-R1-GRPO-math-lighteval-noformatQwen-2.5-Base-7B-gen8-scale-MATH-lighteval-olympiads_aime-ghpoQwen2.5-7B-Open-R1-GRPO-math-lighteval-weighted-syncQwen2.5-7B-Open-R1-GRPO-math-lighteval-logQwen-2.5-Base-7B-gen8-scale-MATH-lighteval-olympiads_aime-grpoQwen-2.5-Base-7B-gen8-scale-MATH-lighteval-olympiads_aime-unique-grpo-beta0-epoch2Qwen-2.5-Base-3B-gen8-scale-MATH-lighteval-olympiads_aime-unique-ghpo-beta0-epoch3Qwen2.5-7B-Open-R1-GRPO-math-lighteval-olympiads-aime-unique-cosine-onlyQwen2.5-7B-Open-R1-GRPO-math-lighteval-olympiads-aime-unique-cosine-noRW-noformatQwen2.5-1.5B-MATH-lighteval-gen-SFTQwen2.5-3B-MATH-lighteval-gen-SFT-15epochQwen2.5-7B-Open-R1-GRPO-math-lighteval-olympiads-aime-unique-cosineQwen-2.5-Base-7B-gen8-scale-MATH-lighteval-olympiads_aime-unique-ghpo-beta0-epoch2Llama-math-lighteval-finetunebloom-3b-lora-lighteval-mmlu-high_school_computer_science-choice-q-a-taskLlama-math-lighteval-finetune_testTest_SmolLM-135M-lighteval-finetune
