yukimakura/Qwen3.8-27B-Q4_K_M-GGUF-2GB-split
053
Qwen3.8-27B-Q4KM GGUF (2GB split shards)
lmstudio-community/Qwen3.8-27B-GGUF の Qwen3.8-27B-Q4_K_M.gguf を、llama.cpp の llama-gguf-split で 1ファイルあたり最大2GB に分割して 再アップロードしたものです。量子化のやり直しはしておらず、テンソルデータは元ファイルとビット単位で同一です (分割はロスレスで、精度は一切変わりません)。
- Model creator: Qwen
- Original model: Qwen/Qwen3.8-27B
- GGUF quantization: LM Studio team (llama.cpp
b10430) - Split:
llama-gguf-split --split --split-max-size 2G(llama.cppb10408)
ファイル
使い方
llama.cpp
先頭シャードだけを指定すれば、残りは自動的に読み込まれます(結合作業は不要)。
huggingface-cli download yukimakura/Qwen3.8-27B-Q4_K_M-GGUF-2GB-split --local-dir ./Qwen3.8-27B-Q4_K_M
llama-cli -m ./Qwen3.8-27B-Q4_K_M/Qwen3.8-27B-Q4_K_M-00001-of-00009.gguf \
--mmproj ./Qwen3.8-27B-Q4_K_M/mmproj-Qwen3.8-27B-BF16.gguf1ファイルに結合したい場合
llama-gguf-split --merge \
Qwen3.8-27B-Q4_K_M-00001-of-00009.gguf \
Qwen3.8-27B-Q4_K_M.gguf結合後のテンソルデータは元の Qwen3.8-27B-Q4_K_M.gguf とビット単位で同一です (全 16,799,719,424 バイトを実際に比較して確認済み)。
なお llama-gguf-split --merge は split.no / split.count / split.tensors.count の メタデータを残す仕様のため、結合後のファイル全体のサイズは元より64バイト大きくなります (推論結果には影響しません)。
ライセンス
Apache-2.0(元モデル Qwen/Qwen3.8-27B に従います)。
