CoolFace
Datasetpublic

XianKa-Zhong/XianKa-Cat-4D-Data

XianKa-Cat-4D-Data 两位抖音博主的视频数据集 + SAM 2.1 语义分割结果,按博主(抖音号/UID)分别打包。 本数据集不包含 4D 重建点云——请使用 4RC 对视频自行运行 4D 重建。 内容 文件/目录 说明 28680959431.tar 博主"显卡从"(抖音号 28680959431):1342 个视频 + metadata.json 28680959431_seg.tar 该博主的 SAM 2.1 分割结果 96187538465.tar 博主"史官"(抖音号 96187538465):569 个视频 + metadata.json 96187538465_seg.tar 该博主的 SAM 2.1 分割结果 examples/ 每位博主 10 个样例(视频 + 对应分割),平铺可直接在线浏览 manifest.json 打包清单与统计 视频文件名为 序号_作品ID.mp4;metadata.json 中 aweme_id 与作品 ID… See the full description on the dataset page: https://huggingface.co/datasets/XianKa-Zhong/XianKa-Cat-4D-Data.

sourceHugging Faceupdated 9d agoView on Hugging Face
0likes381downloads
Dataset Card

XianKa-Cat-4D-Data

两位抖音博主的视频数据集 + SAM 2.1 语义分割结果,按博主(抖音号/UID)分别打包。 本数据集不包含 4D 重建点云——请使用 4RC 对视频自行运行 4D 重建。

内容

文件/目录说明
28680959431.tar博主"显卡从"(抖音号 28680959431):1342 个视频 + metadata.json
28680959431_seg.tar该博主的 SAM 2.1 分割结果
96187538465.tar博主"史官"(抖音号 96187538465):569 个视频 + metadata.json
96187538465_seg.tar该博主的 SAM 2.1 分割结果
examples/每位博主 10 个样例(视频 + 对应分割),平铺可直接在线浏览
manifest.json打包清单与统计

视频文件名为 序号_作品ID.mp4;metadata.json 中 aweme_id 与作品 ID 对应,含标题/点赞/评论等元数据。 tar 均为未压缩归档(纯打包,字节无损),解压即得与原始一致的目录树。

分割结果格式({UID}_seg/{作品ID}/)

  • —frame_XXX_seg.png:分割叠加图(原始帧 + 彩色实例掩码)
  • —masks.npz:键 frame_XXX 对应 (N_masks, H, W) bool 掩码数组
  • —report.json:每帧掩码数量与耗时统计

分割帧:每个视频均匀抽取 ≤30 帧(4RC 推理分辨率 512px)。 掩码为类无关实例分割;需要类别标签可自行接 CLIP / Grounding DINO。

4D 重建(自行运行)

bash
git clone https://github.com/Luo-Yihang/4RC && cd 4RC
python inference.py --input <某个视频或抽帧目录> --save recon.npz

recon.npz 内含每帧 pred_{i}_pts(点云)与 view_{i}_img(RGB)等,可用于点云可视化/深度/位姿估计。

下载与解压

bash
pip install -U huggingface_hub
python -c "from huggingface_hub import snapshot_download; snapshot_download('XianKa-Zhong/XianKa-Cat-4D-Data', repo_type='dataset', local_dir='.')"
mkdir -p data
for f in 28680959431 28680959431_seg 96187538465 96187538465_seg; do tar -xf "$f.tar" -C data; done

四个 tar 相互独立、内部路径均相对 data/,可并行下载解压。

数据来源与用途

视频爬取自抖音公开作品,仅供学术研究使用(视频理解/分割/4D 重建研究), 版权归原博主所有;如需商用请联系原作者。