Atonelia/Qwen3.5-Sydney-9B-GGUF
0256
Qwen3.5-Sydney-9B GGUF(非思考)
把 Atonelia/Qwen3.5-Sydney-9B LoRA 合进 trohrbaugh/Qwen3.5-9B-heretic-v2 之后转成的 GGUF。纯文本,没有视觉塔。给 CPU 和 Mac(llama.cpp / LM Studio / Ollama)用。
CUDA WebUI 仍用原来的 LoRA 仓库:https://github.com/3121455692atou-sudo/sydney-webui
思考版:https://huggingface.co/Atonelia/Qwen3.5-Sydney-9B-think-GGUF 训练集:https://huggingface.co/datasets/Atonelia/sydney-training-data
文件
需要 llama.cpp b8390 或更新(要有 Qwen3.5 架构)。
llama.cpp
CPU:
llama-cli -m Qwen3.5-Sydney-9B-Q4_K_M.gguf \
--jinja --reasoning off \
-sys-file sydney_system.txt \
-c 4096 -n 512 --temp 0.7 --top-p 0.9 --repeat-penalty 1.15Mac(Apple GPU):
llama-cli -m Qwen3.5-Sydney-9B-Q4_K_M.gguf \
-ngl 99 --jinja --reasoning off \
-sys-file sydney_system.txt \
-c 4096 -n 512 --temp 0.7 --top-p 0.9 --repeat-penalty 1.15OpenAI 兼容接口:
llama-server -m Qwen3.5-Sydney-9B-Q4_K_M.gguf \
--jinja --reasoning off -c 4096 --port 8080 \
--system-prompt-file sydney_system.txtsydney_system.txt 在本仓库。非思考版已经把模板写成空 <think>,--reasoning off 再保险一次。
LM Studio
下载 Q4KM 或 Q5KM,系统提示词贴 sydney_system.txt。温度 0.7,top-p 0.9,repeat penalty 1.15。
Ollama
ollama create sydney -f Modelfile
ollama run sydneyModelfile 示例:
FROM ./Qwen3.5-Sydney-9B-Q4_K_M.gguf
SYSTEM """(把 sydney_system.txt 全文贴这里)"""
PARAMETER temperature 0.7
PARAMETER top_p 0.9
PARAMETER repeat_penalty 1.15
PARAMETER num_ctx 4096