gulf-inference/qwen3-8b-gguf
07
qwen3-8b-gguf
Optimized qwen3-8b-gguf for efficient inference.
Usage
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("gulf-inference/qwen3-8b-gguf", trust_remote_code=True)
tokenizer = AutoTokenizer.from_pretrained("gulf-inference/qwen3-8b-gguf", trust_remote_code=True)