moondream/ssv2-3x3
SSV2 3x3 A multi-frame action dataset for teaching a model to look across several frames and describe the action it sees. Each image is a 3x3 collage built from frames sampled from the original Something-Something V2 videos. Splits Split Samples train 150000 test 1000 Columns image: 3x3 frame collage label_text: action label text annotation_text: action template text video_id: original video identifier
048
../
test-00000-of-00010.parquetdownload
test-00001-of-00010.parquetdownload
test-00002-of-00010.parquetdownload
test-00003-of-00010.parquetdownload
test-00004-of-00010.parquetdownload
test-00005-of-00010.parquetdownload
test-00006-of-00010.parquetdownload
test-00007-of-00010.parquetdownload
test-00008-of-00010.parquetdownload
test-00009-of-00010.parquetdownload
train-00000-of-00015.parquetdownload
train-00001-of-00015.parquetdownload
train-00002-of-00015.parquetdownload
train-00003-of-00015.parquetdownload
train-00004-of-00015.parquetdownload
train-00005-of-00015.parquetdownload
train-00006-of-00015.parquetdownload
train-00007-of-00015.parquetdownload
train-00008-of-00015.parquetdownload
train-00009-of-00015.parquetdownload
train-00010-of-00015.parquetdownload
train-00011-of-00015.parquetdownload
train-00012-of-00015.parquetdownload
train-00013-of-00015.parquetdownload
train-00014-of-00015.parquetdownload
