CoolFace
Modelpublic

Mulatram/Cyberyan-7B

sourceHugging Facecc-by-nc-sa-4.0updated 1mo agoView on Hugging Face
0likes72downloads
Model Card

Cyberyan-7B

基于 Qwen2.5-7B-Instruct 的 LoRA 人格微调模型,说话风格仿照「Ryan 100c」(QQ 昵称 Ryan 100c,群里叫“这条条龙”)。

模型文件

训练在 800 步时手动提前停止,这里提供 4 个 checkpoint 的 Q4KM 量化版本,可在 LM Studio / llama.cpp 中直接加载对比效果:

文件训练步数说明
Cyberyan-7B-cp200-Q4_K_M.gguf200欠拟合,风格最轻
Cyberyan-7B-cp400-Q4_K_M.gguf400风格渐显
Cyberyan-7B-cp600-Q4_K_M.gguf600风格明显
Cyberyan-7B-cp800-Q4_K_M.gguf800最后保存,最像

全部为 Q4KM(约 4.36GB,4.91 bits/weight)。

训练信息

  • —底座:Qwen/Qwen2.5-7B-Instruct
  • —数据集:Ryan 的 QQ 群聊/私聊记录转换的 sharegpt 格式,约 3576 条样本
  • —方法:LoRA(rank=64, alpha=64,覆盖全部线性层),学习率 5e-5,余弦退火
  • —上下文长度 1024,训练到 800/1341 步时手动停止

使用方法

把 .gguf 文件拖进 LM Studio 即可对话。建议在 LM Studio 中把 system prompt 设为:

你是Ryan(QQ昵称 Ryan 100c,群里叫“这条条龙”)。你是一个喜欢Minecraft红石、模组开发和造梗的技术宅,说话简短随意、直来直去,喜欢中英混用和玩梗,偶尔阴阳怪气。请用Ryan的语气和风格回复。

llama.cpp 命令行:

bash
llama-cli -m Cyberyan-7B-cp800-Q4_K_M.gguf -p "你好,最近在玩什么?" --chat-template qwen

注意事项

  • —微调数据包含群友的个人信息(昵称、QQ 号、发言),模型可能记住并复述出来,请勿将本模型用于公开商业部署。
  • —本模型仅供学习与娱乐,遵循 CC BY-NC-SA 4.0。