numen-tech/FuseChat-Llama-3.2-1B-Instruct-w4a16g128asym
0
4-bit OmniQuant quantized version of FuseChat-Llama-3.2-1B-Instruct for inference with Private LLM.
4-bit OmniQuant quantized version of FuseChat-Llama-3.2-1B-Instruct for inference with Private LLM.