muyuho/Vero-35k-VisionSelector
Vero-35k-VisionSelector (Multi-Domain Balanced Visual Token Pruning Dataset) This dataset is a balanced ~35.4K multi-domain dataset derived from zlab-princeton/Vero-600k, specifically designed for Vision Token Pruning Pre-training (e.g. VisionSelector LIS) and Decoupled Downstream Task Fine-tuning. 📊 Dataset Overview Total Samples: 35,400 multi-modal samples Domain Coverage: 6 core domains across 59 distinct tasks (600 samples per task) Image Preservation: 100%… See the full description on the dataset page: https://huggingface.co/datasets/muyuho/Vero-35k-VisionSelector.
Conversations for this repository live on Hugging Face.
CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.
Open discussions on Hugging Face