models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
TIPS-Qwen3-4B-Thinking-2507-AgentTIPS-Qwen3-4B-Instruct-2507-AgentTIPS-Qwen3-4B-Instruct-2507-MathTIPS-Qwen3-4B-Thinking-2507-Mathglm-4_6-stackexchange-tezos-32ep-131kswesmith-nl2bash-stack-bugsseqnl2bash-swesmith-stack-bugsseqGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_adam-beta1_0-91_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_adam-beta1_0-95_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_adam-beta1_0-93_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_warmup-ratio_0-01_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_num-train-epochs_8-0_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_global-batch-size_32_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_warmup-ratio_0-05_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_learning-rate_1e-06_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_num-train-epochs_7.0_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_lr_1e-5_Qwen3-32BGLM-4.6-stackexchange-overflow-sandboxes-32eps-65k-reasoning_global-batch-size_64_Qwen3-32Btulu-v2.5-dpo-13b-stackexchange-60kmerged_0.2_expert_0.8-stack_2xwide_6.6b_sft_stag1.2-lyrical_law_news_software_howto_formattedtext_math_wiki-merge-stackeda1-stack_bashcapsd-qwen3-sciweb-stackexchange-Qwen3-4B-Base-science_cap_b4000_s0bloom-560m-finetuned-the-stack-rusttulu-v2.5-ppo-13b-stackexchange-60kcapsd-qwen3-sciweb-stackexchange-Qwen3-4B-Base-science_ppl_b1000_s0capsd-qwen3-sciweb-stackexchange-Qwen3-4B-Base-science_cap_b1000_s0capsd-qwen3-sciweb-stackexchange-Qwen3-4B-Base-science_ppl_b4000_s0capsd-qwen3-sciweb-stackexchange-Qwen3-4B-Base-science_random_b1000_s0tulu-v2.5-dpo-13b-stackexchange
