CoolFace
Modelpublic

featherless-ai-quants/nvidia-Llama3-ChatQA-1.5-70B-GGUF

sourceHugging Faceupdated 1y agoView on Hugging Face
0likes489downloads
Model Card

nvidia/Llama3-ChatQA-1.5-70B GGUF Quantizations ๐Ÿš€

[image]

Optimized GGUF quantization files for enhanced model performance

Powered by Featherless AI - run any model you'd like for a simple small fee.

Available Quantizations ๐Ÿ“Š

Quantization TypeFileSize
IQ4_XSnvidia-Llama3-ChatQA-1.5-70B-IQ4_XS36496.80 MB (folder)
Q2_Knvidia-Llama3-ChatQA-1.5-70B-Q2_K25153.26 MB (folder)
Q3KLnvidia-Llama3-ChatQA-1.5-70B-Q3_K_L35420.03 MB (folder)
Q3KMnvidia-Llama3-ChatQA-1.5-70B-Q3_K_M32680.03 MB (folder)
Q3KSnvidia-Llama3-ChatQA-1.5-70B-Q3_K_S29480.03 MB (folder)
Q4KMnvidia-Llama3-ChatQA-1.5-70B-Q4_K_M40550.61 MB (folder)
Q4KSnvidia-Llama3-ChatQA-1.5-70B-Q4_K_S38478.11 MB (folder)
Q5KMnvidia-Llama3-ChatQA-1.5-70B-Q5_K_M47635.86 MB (folder)
Q5KSnvidia-Llama3-ChatQA-1.5-70B-Q5_K_S46403.36 MB (folder)
Q6_Knvidia-Llama3-ChatQA-1.5-70B-Q6_K55206.44 MB (folder)
Q8_0nvidia-Llama3-ChatQA-1.5-70B-Q8_071501.78 MB (folder)

โšก Powered by Featherless AI

Key Features

  • โ€”๐Ÿ”ฅ Instant Hosting - Deploy any Llama model on HuggingFace instantly
  • โ€”๐Ÿ› ๏ธ Zero Infrastructure - No server setup or maintenance required
  • โ€”๐Ÿ“š Vast Compatibility - Support for 2400+ models and counting
  • โ€”๐Ÿ’Ž Affordable Pricing - Starting at just $10/month

Links: Get Started | Documentation | Models