muyuho/Vero-35k-VisionSelector
Vero-35k-VisionSelector (Multi-Domain Balanced Visual Token Pruning Dataset) This dataset is a balanced ~35.4K multi-domain dataset derived from zlab-princeton/Vero-600k, specifically designed for Vision Token Pruning Pre-training (e.g. VisionSelector LIS) and Decoupled Downstream Task Fine-tuning. ๐ Dataset Overview Total Samples: 35,400 multi-modal samples Domain Coverage: 6 core domains across 59 distinct tasks (600 samples per task) Image Preservation: 100%โฆ See the full description on the dataset page: https://huggingface.co/datasets/muyuho/Vero-35k-VisionSelector.
Upload images.tar.gz.part_06 with huggingface_hub
Upload images.tar.gz.part_05 with huggingface_hub
Upload images.tar.gz.part_04 with huggingface_hub
Upload images.tar.gz.part_03 with huggingface_hub
Upload images.tar.gz.part_02 with huggingface_hub
Upload images.tar.gz.part_01 with huggingface_hub
Upload images.tar.gz.part_00 with huggingface_hub
Upload folder using huggingface_hub
Upload vero_train_all_35k.verl.jsonl with huggingface_hub
Upload vero_visionselector_all_35k.jsonl with huggingface_hub
Upload summary.json with huggingface_hub
Upload README.md with huggingface_hub
initial commit
