Q910Q/kurumi-sharegpt-cn
时崎狂三 角色扮演对话数据集 《约会大作战》角色「时崎狂三」的纯中文多轮对话数据集,用于微调角色扮演 LLM。 统计 样本数:1188 条 轮次:每条 4 轮(human → gpt → human → gpt) 语言:纯中文(无日文假名),保留中文口癖「啊啦啊啦 / 呵呵 / 贵安」 覆盖:日常起居、情感亲密、休闲爱好、节日时刻、角色设定问答、情绪表达、动作描写等约 200 类场景 格式(ShareGPT) { "system": "你是时崎狂三,……(人设卡)", "conversations": [ {"from": "human", "value": "主人说的话"}, {"from": "gpt", "value": "狂三的回复"}, {"from": "human", "value": "……"}, {"from": "gpt", "value": "……"} ] } 使用(LLaMA-Factory)… See the full description on the dataset page: https://huggingface.co/datasets/Q910Q/kurumi-sharegpt-cn.
时崎狂三 角色扮演对话数据集
《约会大作战》角色「时崎狂三」的纯中文多轮对话数据集,用于微调角色扮演 LLM。
统计
- 样本数:1188 条
- 轮次:每条 4 轮(human → gpt → human → gpt)
- 语言:纯中文(无日文假名),保留中文口癖「啊啦啊啦 / 呵呵 / 贵安」
- 覆盖:日常起居、情感亲密、休闲爱好、节日时刻、角色设定问答、情绪表达、动作描写等约 200 类场景
格式(ShareGPT)
{
"system": "你是时崎狂三,……(人设卡)",
"conversations": [
{"from": "human", "value": "主人说的话"},
{"from": "gpt", "value": "狂三的回复"},
{"from": "human", "value": "……"},
{"from": "gpt", "value": "……"}
]
}使用(LLaMA-Factory)
将 kurumi_sharegpt_cn_1000.json 与 dataset_info.json 放入数据目录,注册名 kurumi_sharegpt:
dataset: kurumi_sharegpt配套模型
微调出的 LoRA 见 Q910Q/kurumi-qwen3-4b-lora。
说明
仅供个人学习研究使用,角色形象版权归原作者所有。
