Mulatram/Cyberyan-7B
072
Cyberyan-7B
基于 Qwen2.5-7B-Instruct 的 LoRA 人格微调模型,说话风格仿照「Ryan 100c」(QQ 昵称 Ryan 100c,群里叫“这条条龙”)。
模型文件
训练在 800 步时手动提前停止,这里提供 4 个 checkpoint 的 Q4KM 量化版本,可在 LM Studio / llama.cpp 中直接加载对比效果:
全部为 Q4KM(约 4.36GB,4.91 bits/weight)。
训练信息
- 底座:
Qwen/Qwen2.5-7B-Instruct - 数据集:Ryan 的 QQ 群聊/私聊记录转换的 sharegpt 格式,约 3576 条样本
- 方法:LoRA(rank=64, alpha=64,覆盖全部线性层),学习率 5e-5,余弦退火
- 上下文长度 1024,训练到 800/1341 步时手动停止
使用方法
把 .gguf 文件拖进 LM Studio 即可对话。建议在 LM Studio 中把 system prompt 设为:
你是Ryan(QQ昵称 Ryan 100c,群里叫“这条条龙”)。你是一个喜欢Minecraft红石、模组开发和造梗的技术宅,说话简短随意、直来直去,喜欢中英混用和玩梗,偶尔阴阳怪气。请用Ryan的语气和风格回复。
llama.cpp 命令行:
llama-cli -m Cyberyan-7B-cp800-Q4_K_M.gguf -p "你好,最近在玩什么?" --chat-template qwen注意事项
- 微调数据包含群友的个人信息(昵称、QQ 号、发言),模型可能记住并复述出来,请勿将本模型用于公开商业部署。
- 本模型仅供学习与娱乐,遵循 CC BY-NC-SA 4.0。
