ThijsL202/CraneAILabs_swahili-gemma-1b-GGUF
0114
CraneAILabs_swahili-gemma-1b - GGUF Standard
๐ Quantization Details
- Base Model: CraneAILabs/swahili-gemma-1b
- Quantization: Standard
- Total Size: 4.03 GB (5 files)
๐ฆ Standard Quantizations Classic GGUF quantizations without importance matrix enhancement.
๐ Available Files
๐ Quick Start
llama.cpp
./llama-cli -m CraneAILabs_swahili-gemma-1b.Q6_K.gguf -p "Your prompt here" -n 512Python
from llama_cpp import Llama
llm = Llama(model_path="./CraneAILabs_swahili-gemma-1b.Q6_K.gguf", n_ctx=2048)
output = llm("Your prompt here", max_tokens=512)
print(output["choices"][0]["text"])๐ Model Information
Original model: CraneAILabs/swahili-gemma-1b
Quantized using [llama.cpp](https://github.com/ggml-org/llama.cpp)
