models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
neuralmagic_-_SparseLlama-3-8B-pruned_50.2of4-ggufSparse-Llama-3.1-8B-2of4-GGUFSparseLLM_-_prosparse-llama-2-7b-ggufllama2.c-stories42M-gsm8k-sparse-only-uncompressedSparseLLM_-_prosparse-llama-2-13b-ggufSparse-Llama-3.1-8B-2of4-GGUFZhMax_-_llama-2-7b-ebft-sparsegpt-outlier-wiki-block-outlier-ggufllama2.c-stories42M-gsm8k-sparse-only-compressedneuralmagic-SparseLlama-3-8B-pruned_50.2of4-GGUFSparseLlama-3-8B-pruned_50.2of4-GGUFneuralmagic-Sparse-Llama-3.1-8B-ultrachat_200k-2of4-GGUFSparseGPT-pruned-Llama-2-7b-0.3-GGUFprosparse-llama-2-7bneuralmagic.Sparse-Llama-3.1-8B-2of4-GGUFneuralmagic.Sparse-Llama-3.1-8B-ultrachat_200k-2of4-GGUFprosparse-llama-2-7b-ggufSparse-Llama-3.1-8B-2of4Llama-3.2-3B-Instruct-SparseGPT-GGUFSparse-Llama-3.1-8B-2of4-GGUFSparseLlama-3-8B-pruned_50.2of4Sparse_llama-7Bprosparse-llama-2-13b-ggufSparseLLama-2-7b-ultrachat_200k-pruned_50.2of4GSA-PT-Llama-3.2-1B-chunk4-chunk4Sparse-Llama-3.1-8B-ultrachat_200k-2of4Meta-Llama-3-8B-Instruct-SparseLoRAprosparse-llama-2-13bSparse-Llama-3.1-8B-ultrachat_200k-2of4-quantized.w4a16SparseLlama-2-7b-evolcodealpaca-pruned_50.2of4Sparse-Llama-3.1-8B-gsm8k-2of4
