zy984764389/lin-daiyu-multimodel-lab
0
AI 林黛玉·四模型对比实验室
网页中可逐轮切换四种模型:Qwen3 4B Q4KM、Qwen2.5 1.5B Q3KM、 Qwen3.5 0.8B Q80 与 Qwen3 0.6B Q80。四个 llama.cpp 服务同时常驻,切换无需重新加载; 会话历史按模型隔离,回答下方显示本轮实际模型与生成时间。
四个模型使用完全相同的角色配置、543 条精校林黛玉对白,以及《红楼梦》120 回全文的 2,211 个检索片段。全文来自中文维基文库《红楼梦》120 回汇校本。 原作属于公有领域,维基文库整理文本按 CC BY-SA 4.0 提供。
建议硬件为 T4 small。全部模型同时驻留,适合低并发的公开对比测试;从休眠状态启动时需先 下载、加载并预热四个模型,因此首次访问时间不计入回答延迟。
用户体验问卷
体验四个模型后,欢迎填写 AI 林黛玉四模型对比测试问卷。 问卷用于比较响应速度、角色还原、原著一致性和多轮对话表现。
API
GET /api/health:四个模型各自的在线状态GET /api/models:可选模型列表POST /api/chat:{"message":"……", "model_id":"qwen3-0.6b-q8", "session_id":"可选"}POST /api/reset:清空一个浏览器会话在全部模型上的历史
本项目展示的是基于文学作品的 AI 角色模拟,不代表历史人物或原作者观点。
