QuantTrio/KAT-Dev-GPTQ-Int4
192
1{2 "bits": 4,3 "group_size": 128,4 "desc_act": false,5 "sym": true,6 "lm_head": false,7 "quant_method": "gptq",8 "checkpoint_format": "gptq",9 "pack_dtype": "int32",10 "meta": {11 "quantizer": [12 "gptqmodel:4.2.5"13 ],14 "uri": "https://github.com/modelcloud/gptqmodel",15 "damp_percent": 0.05,16 "damp_auto_increment": 0.01,17 "static_groups": false,18 "true_sequential": true,19 "mse": 0.0,20 "v2": false,21 "v2_alpha": 0.25,22 "act_group_aware": false23 }24}