CoolFace
Datasetpublic

jiaqianjing/animagine-xl-3.1-characterfull-zh

animagine-xl-3.1-characterfull-zh 背景 cagliostrolab/animagine-xl-3.1 Image Prompt 仍然需要中英文输入角色名称,并且有一定格式要求。Prompt Format 如下所示, 1girl/1boy, character name, from what series, everything else in any order. 但是这对于小白,或者不熟悉训练过程的人带来了很高的接入门槛。因此,想通过向量检索的方式降低这种接入成本。但是不管现在任何一种 embedding 的模型(bge-m3, jina-embeddings-v2-base-zh等),都没有办法很好的匹配中文关键字和 官方提供的这份 角色全名单. 因此,想在原有的名单上补充中文角色和中文作品名称的信息,从而提升向量检索的效果。 详情 由于原始文件很大,需要切分成 50 份文件,每份文件 100 条记录; 给出 one-shot, 通过调用 gpt 或者… See the full description on the dataset page: https://huggingface.co/datasets/jiaqianjing/animagine-xl-3.1-characterfull-zh.

sourceHugging Facemitupdated 3y agoView on Hugging Face
0likes14downloads
Dataset Card

animagine-xl-3.1-characterfull-zh

背景

cagliostrolab/animagine-xl-3.1 Image Prompt 仍然需要中英文输入角色名称,并且有一定格式要求。Prompt Format 如下所示,

1girl/1boy, character name, from what series, everything else in any order.

但是这对于小白,或者不熟悉训练过程的人带来了很高的接入门槛。因此,想通过向量检索的方式降低这种接入成本。但是不管现在任何一种 embedding 的模型(bge-m3, jina-embeddings-v2-base-zh等),都没有办法很好的匹配中文关键字和 官方提供的这份 角色全名单. 因此,想在原有的名单上补充中文角色和中文作品名称的信息,从而提升向量检索的效果。

详情

  1. 1.由于原始文件很大,需要切分成 50 份文件,每份文件 100 条记录;
  2. 2.给出 one-shot, 通过调用 gpt 或者 kimi 等模型,在每行行尾添加对应的中文角色名称和中文作品名称,格式如下:
   1girl, souryuu asuka langley, neon genesis evangelion#惣流·明日香·兰格雷#新世纪福音战士  
   1girl, warrior of light, final fantasy#光之战士#最终幻想  
   1girl, akiyama mio, k-on!#秋山 澪#轻音少女  
   1girl, tifa lockhart, final fantasy#蒂法·洛克哈特#最终幻想  
   1girl, 2b, nier:automata#2B#尼尔:自动人形  
  1. 1.最后在合并;