XianKa-Zhong/XianKa-Cat-4D-Data
XianKa-Cat-4D-Data 两位抖音博主的视频数据集 + SAM 2.1 语义分割结果,按博主(抖音号/UID)分别打包。 本数据集不包含 4D 重建点云——请使用 4RC 对视频自行运行 4D 重建。 内容 文件/目录 说明 28680959431.tar 博主"显卡从"(抖音号 28680959431):1342 个视频 + metadata.json 28680959431_seg.tar 该博主的 SAM 2.1 分割结果 96187538465.tar 博主"史官"(抖音号 96187538465):569 个视频 + metadata.json 96187538465_seg.tar 该博主的 SAM 2.1 分割结果 examples/ 每位博主 10 个样例(视频 + 对应分割),平铺可直接在线浏览 manifest.json 打包清单与统计 视频文件名为 序号_作品ID.mp4;metadata.json 中 aweme_id 与作品 ID… See the full description on the dataset page: https://huggingface.co/datasets/XianKa-Zhong/XianKa-Cat-4D-Data.
XianKa-Cat-4D-Data
两位抖音博主的视频数据集 + SAM 2.1 语义分割结果,按博主(抖音号/UID)分别打包。 本数据集不包含 4D 重建点云——请使用 4RC 对视频自行运行 4D 重建。
内容
视频文件名为 序号_作品ID.mp4;metadata.json 中 aweme_id 与作品 ID 对应,含标题/点赞/评论等元数据。 tar 均为未压缩归档(纯打包,字节无损),解压即得与原始一致的目录树。
分割结果格式({UID}_seg/{作品ID}/)
frame_XXX_seg.png:分割叠加图(原始帧 + 彩色实例掩码)masks.npz:键frame_XXX对应(N_masks, H, W)bool 掩码数组report.json:每帧掩码数量与耗时统计
分割帧:每个视频均匀抽取 ≤30 帧(4RC 推理分辨率 512px)。 掩码为类无关实例分割;需要类别标签可自行接 CLIP / Grounding DINO。
4D 重建(自行运行)
git clone https://github.com/Luo-Yihang/4RC && cd 4RC
python inference.py --input <某个视频或抽帧目录> --save recon.npzrecon.npz 内含每帧 pred_{i}_pts(点云)与 view_{i}_img(RGB)等,可用于点云可视化/深度/位姿估计。
下载与解压
pip install -U huggingface_hub
python -c "from huggingface_hub import snapshot_download; snapshot_download('XianKa-Zhong/XianKa-Cat-4D-Data', repo_type='dataset', local_dir='.')"
mkdir -p data
for f in 28680959431 28680959431_seg 96187538465 96187538465_seg; do tar -xf "$f.tar" -C data; done四个 tar 相互独立、内部路径均相对 data/,可并行下载解压。
数据来源与用途
视频爬取自抖音公开作品,仅供学术研究使用(视频理解/分割/4D 重建研究), 版权归原博主所有;如需商用请联系原作者。
