CoolFace
Modelpublic

speakleash/Bielik-11B-v2.2-Instruct-Quanto-8bit

sourceHugging Faceapache-2.0updated 2y agoView on Hugging Face
4likes174downloads
Model Card

<p align="center"> <img src="https://huggingface.co/speakleash/Bielik-7B-Instruct-v0.1-GGUF/raw/main/speakleash_cyfronet.png"> </p>

Bielik-11B-v2.2-Instruct-Quanto-8bit

This model was converted to Quanto format from SpeakLeash's Bielik-11B-v.2.2-Instruct.

DISCLAIMER: Be aware that quantised models show reduced response quality and possible hallucinations!

About Quanto

Optimum Quanto is a pytorch quantization backend for optimum. Model can be loaded using:

from optimum.quanto import QuantizedModelForCausalLM

qmodel = QuantizedModelForCausalLM.from_pretrained('speakleash/Bielik-11B-v2.2-Instruct-Quanto-8bit')

Model description:

Responsible for model quantization

  • —Remigiusz Kinas<sup>SpeakLeash</sup> - team leadership, conceptualizing, calibration data preparation, process creation and quantized model delivery.

Contact Us

If you have any questions or suggestions, please use the discussion tab. If you want to contact us directly, join our Discord SpeakLeash.