beezza/ogiri-bokete-unsloth-vlm
Japanese Bokete Ogiri — Unsloth VLM format YANS-official/ogiri-bokete を、UnslothのVision SFTで扱える会話形式に変換した非公開用データセットです。 各JSONLレコードは「1画像 + 1回答」です。 { "messages": [ {"role": "user", "content": [ {"type": "image", "image": "images/124469.jpg"}, {"type": "text", "text": "この画像のお題に対して、面白い一言を1つ返してください。"} ]}, {"role": "assistant", "content": [ {"type": "text", "text": "..."} ]} ] } Files train.jsonl: 1,678 records / 630 prompts… See the full description on the dataset page: https://huggingface.co/datasets/beezza/ogiri-bokete-unsloth-vlm.
Japanese Bokete Ogiri — Unsloth VLM format
YANS-official/ogiri-bokete を、UnslothのVision SFTで扱える会話形式に変換した非公開用データセットです。
各JSONLレコードは「1画像 + 1回答」です。
{
"messages": [
{"role": "user", "content": [
{"type": "image", "image": "images/124469.jpg"},
{"type": "text", "text": "この画像のお題に対して、面白い一言を1つ返してください。"}
]},
{"role": "assistant", "content": [
{"type": "text", "text": "..."}
]}
]
}Files
train.jsonl: 1,678 records / 630 promptsvalidation.jsonl: 181 records / 70 promptsimages/: 700 JPEG imagesdataset_info.json: conversion metadata
回答は各お題のスコア上位3件を採用し、validationはお題単位で分割しています。 画像パスはデータセットディレクトリからの相対パスです。ローカルへダウンロードして、学習時にそのディレクトリを OGIRI_DATA_DIR へ指定してください。
Source and usage
Source: `YANS-official/ogiri-bokete`
元データはBokete由来です。元データセットカードにあるライセンス、画像の権利、サービスの利用規約を確認したうえで利用してください。このリポジトリはprivateですが、privateであることは第三者コンテンツの権利を変更しません。
