ngqtrung/video-r1-llava-mc-v1
--- language: - en license: apache-2.0 size_categories: - 10K<n<100K task_categories: - video-text-to-text tags: - multimodal-rl - qwen3-vl - gspo - grpo --- # ngqtrung/video-r1-llava-mc-v1 Curated v1 dataset for multimodal RL fine-tuning of Qwen3-VL-4B-Instruct. | Property | Value | |---|---| | Rows | 72421 | | Modality | video | | Split | train | | Schema | verl-ready (prompt + images + videos +… See the full description on the dataset page: https://huggingface.co/datasets/ngqtrung/video-r1-llava-mc-v1.
06
Add auto-generated README
Upload train parquet (72421 rows)
initial commit
