CoolFace
Modelpublic

INC4AI/albert-base-v2-sst2-int8-dynamic-inc

sourceHugging Faceapache-2.0updated 3y agoView on Hugging Face
0likes18downloads
Model Card

INT8 albert-base-v2-sst2

Post-training dynamic quantization

ONNX

This is an INT8 ONNX model quantized with Intel® Neural Compressor.

The original fp32 model comes from the fine-tuned model Alireza1044/albert-base-v2-sst2.

Test result
INT8FP32
Accuracy (eval-accuracy)0.91860.9232
Model size (MB)5945
Load ONNX model:
python
from optimum.onnxruntime import ORTModelForSequenceClassification
model = ORTModelForSequenceClassification.from_pretrained('Intel/albert-base-v2-sst2-int8-dynamic')
INC4AI/albert-base-v2-sst2-int8-dynamic-inc · CoolFace