models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
qwen3-4b-base-dapo-v4Entropy-Qwen3-8B-Base-DAPO14k-i1-GGUFSelf-Certainty-Qwen3-8B-Base-DAPO14k-i1-GGUFArcherCodeR-1.5B-DAPO-i1-GGUFDAPO-Coding-Qwen2.5-1.5B-Instruct-GGUFCo-rewarding-II-Qwen3-8B-Base-DAPO14k-i1-GGUFGT-Qwen3-8B-Base-DAPO14k-i1-GGUFMajority-Voting-Qwen3-8B-Base-DAPO14k-i1-GGUFDAPO-No-DS-7B-GGUFDAPO-7B-GGUFDAPO-8B-GGUFMMR-DAPO-8B-GGUFGT-Qwen3-4B-Base-DAPO14k-GGUFEntropy-Llama-3.2-3B-Instruct-DAPO14k-GGUFCo-rewarding-III-Llama-3.2-3B-Instruct-DAPO14k-GGUFinframind-0.5b-dapo-GGUFCo-rewarding-I-Llama-3.2-3B-Instruct-DAPO14k-GGUFCo-rewarding-III-Qwen3-8B-Base-DAPO14k-GGUFCo-rewarding-II-Qwen3-4B-Base-DAPO14k-GGUFQwen3-1.7B-MATH-DAPO-GRPO-GGUFDAPO-No-DS-8B-GGUFMajority-Voting-Llama-3.2-3B-Instruct-DAPO14k-GGUFMMR-DAPO-7B-GGUFArcherCodeR-1.5B-DAPO-GGUFGT-Llama-3.2-3B-Instruct-DAPO14k-GGUFCo-rewarding-I-Qwen3-8B-Base-DAPO14k-GGUFSelf-Certainty-Qwen3-8B-Base-DAPO14k-GGUFSelf-Certainty-Llama-3.2-3B-Instruct-DAPO14k-GGUFCo-rewarding-II-Qwen3-8B-Base-DAPO14k-GGUFGT-Qwen3-8B-Base-DAPO14k-GGUF
