CoolFace
Datasetpublic

beezza/ogiri-bokete-unsloth-vlm

Japanese Bokete Ogiri — Unsloth VLM format YANS-official/ogiri-bokete を、UnslothのVision SFTで扱える会話形式に変換した非公開用データセットです。 各JSONLレコードは「1画像 + 1回答」です。 { "messages": [ {"role": "user", "content": [ {"type": "image", "image": "images/124469.jpg"}, {"type": "text", "text": "この画像のお題に対して、面白い一言を1つ返してください。"} ]}, {"role": "assistant", "content": [ {"type": "text", "text": "..."} ]} ] } Files train.jsonl: 1,678 records / 630 prompts… See the full description on the dataset page: https://huggingface.co/datasets/beezza/ogiri-bokete-unsloth-vlm.

sourceHugging Faceupdated 2mo agoView on Hugging Face
0likes32downloads
Dataset Card

Japanese Bokete Ogiri — Unsloth VLM format

YANS-official/ogiri-bokete を、UnslothのVision SFTで扱える会話形式に変換した非公開用データセットです。

各JSONLレコードは「1画像 + 1回答」です。

json
{
  "messages": [
    {"role": "user", "content": [
      {"type": "image", "image": "images/124469.jpg"},
      {"type": "text", "text": "この画像のお題に対して、面白い一言を1つ返してください。"}
    ]},
    {"role": "assistant", "content": [
      {"type": "text", "text": "..."}
    ]}
  ]
}

Files

  • train.jsonl: 1,678 records / 630 prompts
  • validation.jsonl: 181 records / 70 prompts
  • images/: 700 JPEG images
  • dataset_info.json: conversion metadata

回答は各お題のスコア上位3件を採用し、validationはお題単位で分割しています。 画像パスはデータセットディレクトリからの相対パスです。ローカルへダウンロードして、学習時にそのディレクトリを OGIRI_DATA_DIR へ指定してください。

Source and usage

Source: `YANS-official/ogiri-bokete`

元データはBokete由来です。元データセットカードにあるライセンス、画像の権利、サービスの利用規約を確認したうえで利用してください。このリポジトリはprivateですが、privateであることは第三者コンテンツの権利を変更しません。