FoldPlanet-500
收藏资源简介:
FoldPlanet-500是一个高质量、结构化、可学习的真实泛化场景叠衣动作数据集,包含500+小时多样化的叠衣任务实例,覆盖不同衣物、不同折叠阶段。数据集包括多角度、高分辨率视频、视觉问答数据、思维链数据和动作捕捉数据,旨在帮助模型学习人类的行为逻辑、操作方式、物体交互特征以及任务理解能力。
FoldPlanet-500 is a high-quality, structured, learnable real-world generalizable clothing folding action dataset, containing over 500 hours of diverse clothing folding task instances covering various garment types and distinct folding stages. The dataset includes multi-angle high-resolution videos, visual question answering (VQA) data, chain-of-thought data, and motion capture data, aiming to assist models in learning human behavioral logic, operational modes, object interaction characteristics, and task understanding capabilities.
FoldPlanet-500数据集概述
基本信息
- 数据集名称:FoldPlanet-500折叠星球
- 数据集类型:衣物折叠In-the-wild Human数据集
- 版本:1.0
- 发布机构:上海星际硅途技术有限公司
- 发布日期:2025-10-24
数据集简介
专为具身智能人形机器人训练设计的高质量、结构化、可学习的真实泛化场景叠衣动作数据集。旨在帮助模型学习人类的行为逻辑、操作方式、物体交互特征以及任务理解能力。
核心价值
- 真实场景,专业动作:包含常见衣物类型的专业级折叠流程,由专业人员在真实场景执行验证
- 多模态数据,精准对齐:
- 视觉感知:多角度高分辨率视频图像序列
- 动作捕捉:全身31节点动作捕捉技术
- 语义标注:详尽步骤化自然语言指令
- 规模化与标准化:包含500+小时高质量叠衣任务实例
数据内容
| 数据类型 | 内容描述 | 数据格式 |
|---|---|---|
| 视频数据 | 多视角高分辨率视频 | .mp4 |
| 视觉问答(VQA) | 任务关键帧的视觉QA数据 | .jsonl/.png |
| 思维链(CoT) | 任务思考推理数据 | .jsonl/.png |
| 动作捕捉(Mocap) | 全身关节运动轨迹数据 | .bvh |
应用场景
- 具身智能与人形机器人控制策略学习
- 多模态感知融合(视觉-语言-动作)
- 操作意图识别与动作模仿学习
- 自监督行为理解模型训练
- 人机交互与任务规划研究
数据质量保证
- 所有数据均经清洗处理
- 视频与动作捕捉帧对齐误差控制在±10ms内
- 标注由多名人员完成并交叉验证
联系方式
- 微信:divinejxy
- 邮箱:chaoshunj@stellarnexrobotics.com




