datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
scanqa_images_64_336x224_672x448_multiturnjp1924_multiturn_kvqaThis dataset is llava style multiturn vlm dataset from jp1924/KoreanImageCaptioningDataset.
multi-turn
InterSyn: A High-Quality Dataset and Reliable Evaluation for Interleaved Image-Text Generation
This dataset card accompanies the paper
A High-Quality Dataset and Reliable Evaluation for Interleaved Image-Text GenerationYukang Feng, Jianwen Sun, Chuanhao Li, Zizhen Li, Jiaxin Ai, Fanrui Zhang, Yifan Chang, Sizhuo Zhou, Shenglin Zhang, Yu Dai, Kaipeng Zhang (2025)
🧠 Introduction
TL;DR InterSyn is a high-quality dataset for instruction‑following, interleaved image–text… See the full description on the dataset page: https://huggingface.co/datasets/finyorko/multi-turn.multiturn_gamebakllava-multiturn-ecommercemultiturn_game_tit_geminimnist_multiturn_sftThe dataset is created using the following script: https://gist.github.com/vermouth1992/e339c22f7591f2f9d8557df228c438e4
MultiTurn-testmultiturn_game_titgame_multiturn_less5_singleturnpi-multiturn-no-redundantBV175_multiturnBV175_multiturn_chatMulti_Turn_eval_filteredMulti_Turn_com
