models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
Qwen3-4B-multilingual-sft-GGUFhal0-brain-sft-fpx4-agentQwen3_4B_SFT_DPO_agent_v0qwen3-4b-agent-sft-dpo-mergedqwen3-4b-agent-sft-truecoding-agent-qwen-sft-v2coding-agent-qwen-sft-v3hal0-brain-sft-fpx8-agentLFM2.5-8B-A1B-KO-Agentic-SFTagentic-4b-2607-sftqwen2.5-7b-agent-sft-v13Qwen3_4B_SFT_DPOv1_agent_v0Qwen3_4B_SFT_DPOv3_agent_v0_LR1E6coding-agent-qwen-sftQwen3_4B_SFT_DPO_agent_v1_LR1E6qwen3-4b-agent-trajectory-merged3-sftdpo_v8barbet-1b-base-agent-sft-tw-fullftMinesweeper_agent_Qwen3_0.6B-SFTMinesweeper_agent_Qwen3_0.6B-SFT-ThinkingQwen3_4B_SFTV5_DPOv3_agent_v0_LR5E7qwen3-4b-agent-sft-lora96_dropout-mergedQwen3-4B-ALFWorld-DBBench-Agent-SFT-03Qwen3-4B-ALFWorld-Agent-SFT-01Qwen3_4B_SFT_DPOv3_agent_v0_LR5E7qwen3-4b-agent-sft-accum8_lr3e-6-mergedqwen3-4b-agent-trajectory-merged11-sftdpo_v14Qwen3-4B-ALFWorld-DBBench-Agent-SFT-05clingen-gdv-agent-sftQwen3_4B_SFT_DPO_agent_v1_LR1E5Qwen3_4B_SFT_DPOv3_agent_v0_LR1E7
