models
Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.
bugged-myelin-tensorrt-gptjTensorRT-LLM-engine-Mistral-7B-instruct-v0.2distilbert-base-uncased-sst2-onnx-int8-for-tensorrttensorrtqwen-primeai-4bit-tensorrtTensorRT_Llama-3.1-Minitron-4B-Width-Basephi2-tensorrtMixtral-TensorRTtensorrtllm_mixtral_dpo_enginemixtral_tensorrt_a100_tp4_w4_all_sttinyllama-tensorrtairoboros-l2-70B-tensorRT-model-tp2airoboros-2.2.1-y34b-tensorRT-uq-bs12mixtral_tensorrt_h100_tp2_w2_nvlinkairoboros-7b-tensorrtMeta-Llama-3-8B-GPTQ-tensorrtWayra-Perplexity-Estimator-55M-TensorRTmixtral_tensorrt_a100_tp2_w2_nvlinkmixtral_tensorrt_a100_tp2_w2_paged_kvcachemixtral_tensorrt_a100_tp2_w2_paged_fusedMLPmixtral_tensorrt_a100_tp2_w2gpt-j-6B-tensorrt-int8gpt2-tensorrtchatglm3_6b_32k_TensorRTReady
