nusshao/SocialNav-Dataset
SocialNav-SUB数据集制作 Background Raw Dataset地址为 https://huggingface.co/datasets/michaelmunje/SocialNav-SUB 根据原论文,是一个VQA(Video Question Answering)的数据集。 但是作者只提供了Raw Data,没法直接用来训练VLM。此项目为制作openai-chat格式的VQA数据集,用于llama-factory的SFT训练。 前视图提取 作者提供的human-labeled的RGB图像,是front-view和BEV拼接在一起的。 我们运行extract_labeled.py将labeled RGB提取到/labeled_front_view文件夹中,同时保留num of people的信息。 最后,运行downsample.py将图片分辨率降采样为640*360。 问答对构建 运行build_dataset.py即可… See the full description on the dataset page: https://huggingface.co/datasets/nusshao/SocialNav-Dataset.
022
1*.7z filter=lfs diff=lfs merge=lfs -text2*.arrow filter=lfs diff=lfs merge=lfs -text3*.bin filter=lfs diff=lfs merge=lfs -text4*.bz2 filter=lfs diff=lfs merge=lfs -text5*.ckpt filter=lfs diff=lfs merge=lfs -text6*.ftz filter=lfs diff=lfs merge=lfs -text7*.gz filter=lfs diff=lfs merge=lfs -text8*.h5 filter=lfs diff=lfs merge=lfs -text9*.joblib filter=lfs diff=lfs merge=lfs -text10*.lfs.* filter=lfs diff=lfs merge=lfs -text11*.lz4 filter=lfs diff=lfs merge=lfs -text12*.mds filter=lfs diff=lfs merge=lfs -text13*.mlmodel filter=lfs diff=lfs merge=lfs -text14*.model filter=lfs diff=lfs merge=lfs -text15*.msgpack filter=lfs diff=lfs merge=lfs -text16*.npy filter=lfs diff=lfs merge=lfs -text17*.npz filter=lfs diff=lfs merge=lfs -text18*.onnx filter=lfs diff=lfs merge=lfs -text19*.ot filter=lfs diff=lfs merge=lfs -text20*.parquet filter=lfs diff=lfs merge=lfs -text21*.pb filter=lfs diff=lfs merge=lfs -text22*.pickle filter=lfs diff=lfs merge=lfs -text23*.pkl filter=lfs diff=lfs merge=lfs -text24*.pt filter=lfs diff=lfs merge=lfs -text25*.pth filter=lfs diff=lfs merge=lfs -text26*.rar filter=lfs diff=lfs merge=lfs -text27*.safetensors filter=lfs diff=lfs merge=lfs -text28saved_model/**/* filter=lfs diff=lfs merge=lfs -text29*.tar.* filter=lfs diff=lfs merge=lfs -text30*.tar filter=lfs diff=lfs merge=lfs -text31*.tflite filter=lfs diff=lfs merge=lfs -text32*.tgz filter=lfs diff=lfs merge=lfs -text33*.wasm filter=lfs diff=lfs merge=lfs -text34*.xz filter=lfs diff=lfs merge=lfs -text35*.zip filter=lfs diff=lfs merge=lfs -text36*.zst filter=lfs diff=lfs merge=lfs -text37*tfevents* filter=lfs diff=lfs merge=lfs -text38# Audio files - uncompressed39*.pcm filter=lfs diff=lfs merge=lfs -text40*.sam filter=lfs diff=lfs merge=lfs -text41*.raw filter=lfs diff=lfs merge=lfs -text42# Audio files - compressed43*.aac filter=lfs diff=lfs merge=lfs -text44*.flac filter=lfs diff=lfs merge=lfs -text45*.mp3 filter=lfs diff=lfs merge=lfs -text46*.ogg filter=lfs diff=lfs merge=lfs -text47*.wav filter=lfs diff=lfs merge=lfs -text48# Image files - uncompressed49*.bmp filter=lfs diff=lfs merge=lfs -text50*.gif filter=lfs diff=lfs merge=lfs -text51*.png filter=lfs diff=lfs merge=lfs -text52*.tiff filter=lfs diff=lfs merge=lfs -text53# Image files - compressed54*.jpg filter=lfs diff=lfs merge=lfs -text55*.jpeg filter=lfs diff=lfs merge=lfs -text56*.webp filter=lfs diff=lfs merge=lfs -text57# Video files - compressed58*.mp4 filter=lfs diff=lfs merge=lfs -text59*.webm filter=lfs diff=lfs merge=lfs -text60 