CoolFace
30 shown

models

Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.

Clear all
01inference-optimization /Llama-3.2-0.5B-Instructtext-generationtransformers1 likes25k downloads4mo agoHugging Face02local-inference-lab /Qwen3.8-Flash-Next-NVFP4image-text-to-texttransformers28 likes22k downloads5d agoHugging Face03inference-optimization /Qwen3-1.6B-A0.9Btext-generationtransformers3 likes16k downloads4mo agoHugging Face04local-inference-lab /GLM-5.3-Flash-NVFP4-Sparktext-generationtransformersen6 likes10k downloads5d agoHugging Face05local-inference-lab /GLM-5.3-Flash-NVFP4text-generationtransformersen39 likes9.6k downloads5d agoHugging Face06inference-optimization /Qwen3-8B-from-Qwen3-8B_regen-speculators.eagle3-qwen3arch-ckpt1speculators0 likes7.7k downloads3mo agoHugging Face07inference-optimization /Qwen3-8B-speculators.peagle-qwen3arch-ckpt4speculators1 likes7.7k downloads3mo agoHugging Face08inference-optimization /Qwen3-Coder-Next.w4a16text-generation1 likes6.6k downloads6mo agoHugging Face09inference-optimization /GLM-5.2-0.8B-A0.8Btext-generationtransformers4 likes5.4k downloads3mo agoHugging Face10inference-optimization /DSV4-tiny-empty1 likes5.4k downloads7d agoHugging Face11inference-optimization /DeepSeek-V3-debug-empty-FP8_DYNAMIC0 likes5.3k downloads8mo agoHugging Face12inferencerlabs /Qwen3.8-Flash-Next-MLX-Q9image-text-to-textmlxen1 likes5.1k downloads23d agoHugging Face13inference-optimization /Qwen3.8-1.0B-A0.6Btext-generationtransformers5 likes4.6k downloads1mo agoHugging Face14inferencerlabs /Qwen3.8-Flash-Next-MLX-Q4image-text-to-textmlxen1 likes4.3k downloads22d agoHugging Face15inferencerlabs /DeepSeek-V4.1-MLX-Q4iimage-text-to-textmlxen2 likes3.3k downloads10d agoHugging Face16inference-optimization /Qwen3-8B-speculator.dspark.swa.dpace.fullvocab.muon.2048anc.combdatav4-q235b-instr-v1-ckpt20 likes3.3k downloads1mo agoHugging Face17inference-optimization /Qwen3-8B-speculator.dflash.swa.dpace.fullvocab.muon.2048anc.combdatav3-q235b-instr-v9-ckpt190 likes3.3k downloads1mo agoHugging Face18inference-optimization /Qwen3-8B-speculator.dflash.swa.dpace.fullvocab.muon.2048anc.combdatav3-q235b-instr-v9-ckpt160 likes3.3k downloads1mo agoHugging Face19inference-optimization /Kimi-K3-0.40B-MXFP4compressed-tensors7 likes2.9k downloads3d agoHugging Face20nvidia /Qwen3-VL-235B-A22B-Instruct-NVFP4-MLPerf-Inference-Closed-V6.1-FP8-KV3 likes2.5k downloads3mo agoHugging Face21inferencerlabs /GLM-5.3-Flash-MLX-Q9image-text-to-textmlxen1 likes2.3k downloads23d agoHugging Face22inferencerlabs /GLM-5.3-MLX-Q4itext-generationmlxen0 likes2k downloads21d agoHugging Face23local-inference-lab /GLM-5.2-NVFP4text-generationtransformersen32 likes1.9k downloads2mo agoHugging Face24InferenceIllusionist /Meta-Llama-3.1-8B-Claude-iMat-GGUFtransformers13 likes1.9k downloads2y agoHugging Face25inference-optimization /NemotronH-0.3B-A0.3Btext-generationtransformers1 likes1.8k downloads8d agoHugging Face26inferencerlabs /Hy4-preview-MLX-Q4itext-generationmlxen0 likes1.7k downloads20d agoHugging Face27InferenceIllusionist /Fimbulvetr-11B-v2-iMat-GGUF16 likes1.7k downloads2y agoHugging Face28inferencerlabs /DeepSeek-V4-Flash-Vision-Exp-MLXimage-text-to-textmlxen0 likes1.6k downloads19d agoHugging Face29inference-optimization /qwe3-8B-selfdistill-v3-fresh3ep_ckpt00 likes1.6k downloads7d agoHugging Face30InferenceIllusionist /mini-magnum-12b-v1.1-iMat-GGUFtransformers14 likes1.5k downloads2y agoHugging Face

Listings come live from the Hugging Face Hub API. CoolFace does not host these files.