datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
vlms-are-biased
Vision Language Models are Biased
by
An Vo1*,
Khai-Nguyen Nguyen2*,
Mohammad Reza Taesiri3,
Vy Tuong Dang1,
Anh Totti Nguyen4†,
Daeyoung Kim1†
*Equal contribution †Equal advising
1KAIST, 2College of William and Mary, 3University of Alberta, 4Auburn University
TLDR: State-of-the-art Vision Language Models (VLMs) perform perfectly on counting tasks with original images but fail catastrophically (e.g., 100% → 17.05%… See the full description on the dataset page: https://huggingface.co/datasets/anvo25/vlms-are-biased.vmmu
ViExam: Are Vision Language Models Better than Humans on Vietnamese Multimodal Exam Questions?
by
Vy Tuong Dang*,
An Vo*,
Quang Tau,
Duc Dm,
Daeyoung Kim,
*Equal contribution
KAIST
TLDR: State-of-the-art Vision Language Models (VLMs) demonstrate remarkable capabilities on English multimodal tasks but significantly underperform on Vietnamese educational assessments. ViExam reveals that SOTA VLMs achieve only 57.74% accuracy… See the full description on the dataset page: https://huggingface.co/datasets/anvo25/vmmu.Radiology_Project_Annotatedpendulum-conflict
Pendulum Conflict Dataset
This dataset is a manually curated subset of 100 isolated multimodal conflict examples derived from the akomand/counterfactual_pendulum dataset.
It is designed for evaluating Multimodal Large Language Models (MLLMs) under controlled visual-textual conflicts.
Dataset Statistics
Total Samples: 100
Categories: angle (25), light (25), shadow_len (25), shadow_pos (25)
Language: English
Corrected / Audited Samples: 20
Data Fields… See the full description on the dataset page: https://huggingface.co/datasets/Anvesh-Lankala/pendulum-conflict.cedula_antigua_anverso_v4cedula_antigua_anverso_v6id_anversoNuevomultilingual-crossmodal-conflict-3D_Objectscedula_antigua_anverso_v2Radiology_Projectremote_sensing_VQA_multilingualcedula_antigua_anverso_v3id_anversoAntiguocedula_antigua_anverso_v5project-z-outputproject-z-original-imagesproject_ytrain_animalstest_animals
