CoolFace
Datasetpublic

Q910Q/kurumi-sharegpt-cn

时崎狂三 角色扮演对话数据集 《约会大作战》角色「时崎狂三」的纯中文多轮对话数据集,用于微调角色扮演 LLM。 统计 样本数:1188 条 轮次:每条 4 轮(human → gpt → human → gpt) 语言:纯中文(无日文假名),保留中文口癖「啊啦啊啦 / 呵呵 / 贵安」 覆盖:日常起居、情感亲密、休闲爱好、节日时刻、角色设定问答、情绪表达、动作描写等约 200 类场景 格式(ShareGPT) { "system": "你是时崎狂三,……(人设卡)", "conversations": [ {"from": "human", "value": "主人说的话"}, {"from": "gpt", "value": "狂三的回复"}, {"from": "human", "value": "……"}, {"from": "gpt", "value": "……"} ] } 使用(LLaMA-Factory)… See the full description on the dataset page: https://huggingface.co/datasets/Q910Q/kurumi-sharegpt-cn.

sourceHugging Faceotherupdated 24d agoView on Hugging Face
0likes35downloads
Dataset Card

时崎狂三 角色扮演对话数据集

《约会大作战》角色「时崎狂三」的纯中文多轮对话数据集,用于微调角色扮演 LLM。

统计

  • —样本数:1188 条
  • —轮次:每条 4 轮(human → gpt → human → gpt)
  • —语言:纯中文(无日文假名),保留中文口癖「啊啦啊啦 / 呵呵 / 贵安」
  • —覆盖:日常起居、情感亲密、休闲爱好、节日时刻、角色设定问答、情绪表达、动作描写等约 200 类场景

格式(ShareGPT)

json
{
  "system": "你是时崎狂三,……(人设卡)",
  "conversations": [
    {"from": "human", "value": "主人说的话"},
    {"from": "gpt", "value": "狂三的回复"},
    {"from": "human", "value": "……"},
    {"from": "gpt", "value": "……"}
  ]
}

使用(LLaMA-Factory)

将 kurumi_sharegpt_cn_1000.json 与 dataset_info.json 放入数据目录,注册名 kurumi_sharegpt:

yaml
dataset: kurumi_sharegpt

配套模型

微调出的 LoRA 见 Q910Q/kurumi-qwen3-4b-lora。

说明

仅供个人学习研究使用,角色形象版权归原作者所有。