CoolFace
Modelpublic

xCloudinfo/Gemma-4-26B-A4B-TAIDE-zhTW-GGUF

sourceHugging Faceapache-2.0updated 7d agoView on Hugging Face
1likes821downloads
Model Card

Gemma-4-26B-A4B-TAIDE-zhTW-GGUF

云碩科技 · xCloudinfo · 系列:繁中在地化 · TAIDE zh-TW

`xCloudinfo/Gemma-4-26B-A4B-TAIDE-zhTW` 的 GGUF(llama.cpp / Ollama) 版本,含視覺投影器(mmproj),可圖文對話。六階量化齊全,依裝置 VRAM/CPU 記憶體選用。

檔案量化大小用途
model-Q8_0.ggufQ8_026 GB幾乎無損,資源充足時首選
model-Q6_K.ggufQ6_K22 GB高品質,效能/精度平衡
model-Q5_K_M.ggufQ5KM18 GB品質與體積折衷
model-Q4_K_M.ggufQ4KM16 GB部署首選,一般裝置最常用
model-IQ4_XS.ggufIQ4_XS13 GB較小體積,帶 imatrix 校準
model-IQ2_M.ggufIQ2_M9.7 GB極限壓縮,記憶體受限裝置
imatrix.dat—55 MB量化用重要性矩陣(IQ 系列必須)
mmproj-Gemma-4-26B-A4B-TAIDE-zhTW-f16.gguff161.2 GB視覺投影器(vision)

用法(llama.cpp,含圖文)

bash
llama-server -m model-Q4_K_M.gguf \
  --mmproj mmproj-Gemma-4-26B-A4B-TAIDE-zhTW-f16.gguf -c 4096 -ngl 99
純文字可省略 --mmproj;把 model-Q4_K_M.gguf 換成其他階的檔名即可切換量化等級。

授權與來源聲明


由 云碩科技 xCloudinfo 於自有 AI 算力資源池製作。