models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
DeepScaleR-1.5B-PreviewDeepScaleR-1.5B-Preview-GGUFDeepScaleR-1.5B-Preview-GGUFDeepScaleR-1.5B-Preview-GGUFVinnnf_Thinkless-1.5B-RL-DeepScaleR-GGUFQwen3-1.7B-base-Open-R1-GRPO_deepscaler_acc_8192_noklDeepScaleR-1.5B-6.5bitSegue-Qwen3_DeepScaleR-Preview-Q4_K_M-GGUFThinkless-1.5B-RL-DeepScaleRDeepScaleR-1.5B-Preview-unsloth-bnb-4bitDeepScaleR-1.5B-Preview-mlxDeepScaleR-1.5B-Preview-16bitRAIF-DeepScaleR-1.5BDeepScaleR-1.5B-Preview-4bitDeepSeek-R1-Distill-Qwen-7B-TRPA-DeepScaleR-verl0326DeepScaleR-1.5B-PreviewSFT_DeepScaleR_Llama-3.2-1B_epoch_1_global_step_26Qwen3-1.7B-base-Open-R1-GRPO_deepscaler_acc_8192SFT_DeepScaleR_Llama-3.2-3B_epoch_1_global_step_26deepscaler-1.5b-8k-dapo-hard-step400-hfDeepScaleR-8KDeepScaleR-1.5B-Preview-thinkprune-4kDeepScaleR-1.5B-Preview-Q8DeepScaleR-1.5B-Preview-Reproducedeepscaler-1.5b-8k-reproduce-first-run-with-shuffle-8k-400-chkpt-step-300DeepScaleR-1.5B-Preview-8bit-mlxQwen2.5-Math-1.5B-Open-R1-GRPO_deepscaler_mu_8_constant_lrQwen3-1.7B-Open-R1-GRPO_deepscaler_acc_8192Qwen3-1.7B-base-Open-R1-GRPO_deepscaler_acc_2048deepscaler-1.5b-8k-easy-first-run-with-shuffle-8k-400-chkpt-step-200
