pufanyi/VBVR-Bench
VBVR-Bench Re-hosted copy of Video-Reason/VBVR-Bench-Data, converted to standard HuggingFace parquet format. Splits in_domain: 50 tasks x 5 samples = 250 entries (tasks overlap with the VBVR training set). out_of_domain: 50 tasks x 5 samples = 250 entries (held-out reasoning tasks). Schema field type notes task_name string e.g. G-13_grid_number_sequence_data-generator video_idx string zero-padded sample id (00000..00004) domain… See the full description on the dataset page: https://huggingface.co/datasets/pufanyi/VBVR-Bench.
024
VBVR-Bench
Re-hosted copy of Video-Reason/VBVR-Bench-Data, converted to standard HuggingFace parquet format.
Splits
- `in_domain`: 50 tasks x 5 samples = 250 entries (tasks overlap with the VBVR training set).
- `out_of_domain`: 50 tasks x 5 samples = 250 entries (held-out reasoning tasks).
Schema
Quick load
from datasets import load_dataset
ds = load_dataset("pufanyi/VBVR-Bench", split="in_domain")
sample = ds[0]
sample["first_frame"] # PIL.Image
sample["prompt"] # str
sample["ground_truth_video"] # raw MP4 bytes
# Decode the video with decord
import decord, io
vr = decord.VideoReader(io.BytesIO(sample["ground_truth_video"]))Links
- Upstream dataset: Video-Reason/VBVR-Bench-Data
- Evaluation kit: Video-Reason/VBVR-EvalKit
- Project page: video-reason.com
