CoolFace
Datasetpublic

stellarnexrobotics/FoldPlanet-500

FoldPlanet-500折叠星球 衣物折叠In-the-wild Human数据集 Version: 1.0 Author: 上海星际硅途技术有限公司 Date: 2025-10-24 公司介绍(Company Introduction) 上海星际硅途技术有限公司,成立于2025年4月,2025年9月入驻上海人形机器人孵化器。 我们是一家具身智能数据解决方案服务商,致力于通过“动作捕捉+视觉感知+语义标注”的多模态技术,进行“in-the-wild”场景下的“Human Data”采集,建立通专融合、覆盖千行百业的数据生态,推动具身智能数据行业宽度和深度的发展,促进具身智能大模型的快速迭代。 数据集简介(Dataset Overview) 专为具身智能人形机器人训练而设计的,高质量、结构化、可学习的真实泛化场景叠衣动作数据集。… See the full description on the dataset page: https://huggingface.co/datasets/stellarnexrobotics/FoldPlanet-500.

sourceHugging Faceupdated 10mo agoView on Hugging Face
4likes58downloads
Dataset Card

FoldPlanet-500折叠星球

衣物折叠In-the-wild Human数据集

Version: 1.0

Author: 上海星际硅途技术有限公司

Date: 2025-10-24


公司介绍(Company Introduction)

- 上海星际硅途技术有限公司,成立于2025年4月,2025年9月入驻上海人形机器人孵化器。 - 我们是一家具身智能数据解决方案服务商,致力于通过“动作捕捉+视觉感知+语义标注”的多模态技术,进行“in-the-wild”场景下的“Human Data”采集,建立通专融合、覆盖千行百业的数据生态,推动具身智能数据行业宽度和深度的发展,促进具身智能大模型的快速迭代。

数据集简介(Dataset Overview)

专为具身智能人形机器人训练而设计的,高质量、结构化、可学习的真实泛化场景叠衣动作数据集。 它旨在帮助模型学习人类的行为逻辑、操作方式、物体交互特征以及任务理解能力。

数据主要来源于真实场景、真人操作视频、动作捕捉数据,并经过严格标注与清洗,确保其可用于多模态模型的学习。 是专为训练和评估下一代智能叠衣机器人、衣物折叠算法及计算机视觉模型而打造的核心资源库!

核心价值(Core Values)

真实场景,专业动作

- 数据集包含绝大部分常见衣物类型(如短袖、衬衫、短裤、长裤、长袖T恤、裙子、童装等)的专业级折叠流程。 - 所有折叠步骤均由专业数采人员在真实泛化的场景执行并验证,确保动作的合理性、真实性,基于环境的适配性和最终叠放效果,为机器人学习提供“最佳实践”模板。

多模态数据,精准对齐

- 视觉感知: 每个折叠任务都配备了多角度、高分辨率、时序清晰的视频、图像序列。多视角视频图像数据,精确捕捉每一步操作的关键状态和动作轨迹。 - 动作捕捉:采用全身31节点动作捕捉采样技术,可精准捕获人体全身关节的运动轨迹与姿态变化,生成适配机器人躯干及四肢协同控制的高精度动作数据,为机器人具身智能训练提供核心动作参考。 - 语义标注:我们为每个折叠任务都配备了详尽化、步骤化、可量化的自然语言指令。将图像和自然语言指令进行结构化整理,形成高质量、任务强关联的CoT和VQA数据。适配预训练、finetune、评测多环节,是训练模型理解动作意图和执行步骤的黄金数据。

规模化与标准化的数据处理

- FoldPlanet-500发布即包含500+小时高质量、多样化的叠衣任务实例(覆盖不同衣物、不同折叠阶段)。 - 数据采集过程标准化,确保格式统一、标注规范,极大降低研究者和开发者的数据处理成本。

数据内容(Data Contents)

模块内容描述数据格式
视频数据(Video)人类执行任务的多视角高分辨率视频.mp4
视觉问答 (VQA)由专业标注人员针对任务关键帧,进行空间、场景、动作的视觉QA数据.jsonl/.png
思维链(CoT)由操作者精标,针对每一个任务的思考推理数据.jsonl / .png
动作捕捉(Mocap)每条数据均配有对应多视角视频,通过唯一id编号关联.bvh

应用场景(Applications)

  • —具身智能与人形机器人控制策略学习
  • —多模态感知融合(视觉-语言-动作)
  • —操作意图识别与动作模仿学习
  • —自监督行为理解模型训练
  • —人机交互与任务规划研究

数据结构(Structure & Format)

FoldPlanet-500/
├── CoT/
│   ├── CoT_image/
│   │   ├── session250101_cot001_image001.png
│   │   ├── session250101_cot002_image002.png
│   │   └── ...
│   └── CoT.jsonl
├── VQA/
│   ├── VQA_image/
│   │   ├── session250101_vqa001_image001.png
│   │   ├── session250101_vqa002_image002.png
│   │   └── ...
│   └── VQA.jsonl
├── video/
│   ├── session250101_0101_align
│   │   ├── session250101_0101_align_camera_3.mp4
│   │   ├── session250101_0101_align_camera_h.mp4
│   │   └── ...
│   └── ...
└──  Mocap/
    ├── session250101_0101_align_mocap.bvh
    ├── session250101_0102_align_mocap.bvh
    └── ...

数据清洗与质检(Cleaning and Quality inspection)

  • —所有数据均经清洗处理。
  • —视频与动作捕捉帧对齐误差控制在 ±10ms 内。
  • —标注由多名实操人员和资深标注员完成,并经交叉验证。

联系我们(Contact Us)

我们精挑出了较有代表性的数据,您有任何问题,欢迎随时和我们联系。

如需商用授权或大规模数据访问,请联系:

WeChat: <u>divinejxy</u>

Email: <u>chaoshunj@stellarnexrobotics.com</u>