CoolFace
Datasetpublic

lilvjosephtang/SEAM-Benchmark

SEAM: Semantically Equivalent Across Modalities Benchmark for Vision-Language Models CSSLab, Department of Computer Science, University of Toronto[COLM '25] Second Conference on Language Modeling Paper: Paper Project Page / Leaderboard: SEAM Benchmark Code: GitHub Abstract Evaluating whether vision-language models (VLMs) reason consistently across representations is challenging because modality comparisons are typically confounded by task differences and… See the full description on the dataset page: https://huggingface.co/datasets/lilvjosephtang/SEAM-Benchmark.

sourceHugging Facecc-by-nc-4.0updated 1y agoView on Hugging Face
9likes160downloads
50 commits on main
a0ff9ae1y ago

Update dataset card: License, task category, paper link, and abstract (#2)

lilvjosephtang, nielsr
cc269861y ago

Update README.md

lilvjosephtang
75a82981y ago

Add dataset card

lilvjosephtang
7c53f2d1y ago

Upload SEAM benchmark with 16 task-based splits

lilvjosephtang
92520b71y ago

Clean up old dataset files

lilvjosephtang
37556191y ago

Clean up old dataset files

lilvjosephtang
c22793e1y ago

Clean up old dataset files

lilvjosephtang
63dd9101y ago

Clean up old dataset files

lilvjosephtang
014554c1y ago

Clean up old dataset files

lilvjosephtang
7507fb51y ago

Clean up old dataset files

lilvjosephtang
6b19ce81y ago

Clean up old dataset files

lilvjosephtang
f3492e61y ago

Clean up old dataset files

lilvjosephtang
13babd91y ago

Clean up old dataset files

lilvjosephtang
5c190f01y ago

Clean up old dataset files

lilvjosephtang
2ef0f511y ago

Clean up old dataset files

lilvjosephtang
f1e24451y ago

Clean up old dataset files

lilvjosephtang
15a3c171y ago

Clean up old dataset files

lilvjosephtang
7b79f6d1y ago

Clean up old dataset files

lilvjosephtang
9a922ba1y ago

Clean up old dataset files

lilvjosephtang
6b16a1d1y ago

Clean up old dataset files

lilvjosephtang
530c70b1y ago

Add dataset card

lilvjosephtang
e408a8d1y ago

Upload SEAM benchmark with 16 task-based splits

lilvjosephtang
4bb8bb31y ago

Clean up old dataset files

lilvjosephtang
a1fbee81y ago

Clean up old dataset files

lilvjosephtang
8214e891y ago

Clean up old dataset files

lilvjosephtang
213d92d1y ago

Clean up old dataset files

lilvjosephtang
64d66141y ago

Clean up old dataset files

lilvjosephtang
a4b4a651y ago

Clean up old dataset files

lilvjosephtang
bf796c71y ago

Clean up old dataset files

lilvjosephtang
3d9eb601y ago

Clean up old dataset files

lilvjosephtang
250b3c31y ago

Clean up old dataset files

lilvjosephtang
a40bb541y ago

Clean up old dataset files

lilvjosephtang
64461061y ago

Clean up old dataset files

lilvjosephtang
8fe81c61y ago

Clean up old dataset files

lilvjosephtang
b9514c91y ago

Clean up old dataset files

lilvjosephtang
60ff7361y ago

Clean up old dataset files

lilvjosephtang
9e02f121y ago

Clean up old dataset files

lilvjosephtang
a5a99bf1y ago

Clean up old dataset files

lilvjosephtang
d71d8c91y ago

Add dataset card

lilvjosephtang
9222d3e1y ago

Upload SEAM benchmark with 16 task-based splits

lilvjosephtang
43716a51y ago

Clean up old dataset files

lilvjosephtang
e49642b1y ago

Clean up old dataset files

lilvjosephtang
5596c341y ago

Clean up old dataset files

lilvjosephtang
77223961y ago

Clean up old dataset files

lilvjosephtang
20949651y ago

Clean up old dataset files

lilvjosephtang
71507731y ago

Clean up old dataset files

lilvjosephtang
8d78c841y ago

Clean up old dataset files

lilvjosephtang
8826f311y ago

Clean up old dataset files

lilvjosephtang
f04419f1y ago

Clean up old dataset files

lilvjosephtang
fd049af1y ago

Clean up old dataset files

lilvjosephtang