RoCo_TaskBoardAssembly
收藏资源简介:
RoCo任务板装配演示数据集是一个用于任务板零件装配的真实世界机器人操作数据集。该数据集由Sharpa发布,采用LeRobot兼容格式(v3.0和v2.1),旨在支持模仿学习、视觉运动策略学习、视觉触觉表征学习以及接触丰富操作的研究。数据集专门服务于RoCo IROS 2026挑战赛的任务板装配赛道,为参赛团队提供训练和策略开发数据。数据集包含30个收集季节(seasons),共计562个演示片段(episodes),超过246万帧数据(30 FPS),总规模约324.3 GB。每个演示片段包含多种同步的传感器模态:6个同步的视频流(左/右头部摄像头、左/右手腕摄像头、触觉变形视频、原始触觉视频)、65维的关节空间机器人状态与动作向量(涵盖双臂、双灵巧手及躯干/电机相关关节)、60维的触觉力/扭矩信号(10个指尖各6轴)、关节扭矩信号以及时间戳、帧索引等元数据。该数据集的核心应用场景是训练能够处理接触丰富、需要精确零件定位、精细接触时机、双手协调以及在手-物体遮挡下具有鲁棒感知能力的机器人装配策略。数据结构按季节组织,每个季节均提供`lerobot3.0`(推荐新用户使用)和`lerobotv2.1`(用于向后兼容)两种导出格式,便于用户集成到现有的LeRobot生态系统中进行策略学习和评估。
数据集概述
RoCo Task Board Assembly Demonstrations 是一个真实世界的机器人操作数据集,专注于任务板上的零件装配任务。该数据集由 Sharpa 发布,采用 LeRobot兼容格式,适用于模仿学习、视觉运动策略学习、视觉-触觉表征学习以及接触丰富的操作研究。
核心任务与挑战
- 任务:任务板零件装配,需要精确的零件定位、精细的接触时机、双臂协调,以及在手-物遮挡下的鲁棒感知。
- 挑战:接触丰富、精度敏感,策略需应对物体接触、手部遮挡、触觉事件和精细的姿态调整。
数据集规模与格式
- 总采集季节 (Seasons):30 个
- 总片段 (Episodes):562 个(每个季节对应一个独立采集会话)
- 总帧数 (Frames):2,461,024 帧(在
lerobot3.0和lerobotv2.1中相同) - 帧率 (FPS):30
- 数据格式:
lerobot3.0和lerobotv2.1(每个季节均提供两种格式) - 数据大小:约 324.3 GB
- 许可协议:Creative Commons Attribution 4.0 International (CC-BY-4.0)
数据模态
| 模态类别 | 具体内容 | 详细说明 |
|---|---|---|
| 视觉 (Video) | 6 个同步视频流 | 包括头部左侧、头部右侧、左腕、右腕、触觉形变、原始触觉摄像头,均为 MP4 格式。lerobot3.0 主要采用 AV1 编码,lerobotv2.1 主要采用 H.264 编码。 |
| 状态/动作 (State/Action) | 65 维联合空间向量 | 包含左臂 (7维)、左手 (22维)、右臂 (7维)、右手 (22维)、躯干/电机 (7维)。observation.state 和 action 均为 65 维浮点向量。 |
| 触觉 (Tactile) | 60 维信号 + 双视频流 | 包括 10 个指尖的力/力矩信号(observation.tactile,60 维:指尖 x 6 轴),以及形变导向视频 (observation.images.tactile_deform,480x1200x3) 和原始触觉视频 (observation.images.tactile_raw,480x1600x3)。 |
| 其他 | 关节力矩、时间戳、帧索引等 | observation.state.joint_torque (65维)、timestamp、frame_index、episode_index、task_index。 |
数据结构
数据集按采集季节(Season)组织,每个季节文件夹包含 lerobot3.0 和 lerobotv2.1 两个子目录。
RoCo_TaskBoardAssembly/ ├── season_POC22061_2026_06_11_14_29_08_train/ │ ├── lerobot3.0/ │ │ ├── meta/ # 元数据 (info.json, modality.json, episodes/, tasks.parquet) │ │ ├── data/ # Parquet 帧数据文件 │ │ └── videos/ # 分摄像头的 MP4 视频文件 │ └── lerobotv2.1/ # 相同结构,用于兼容旧版 LeRobot └── season_.../
- 核心元数据文件:
meta/info.json,定义了总片段数、总帧数、FPS、数据拆分、数据路径、视频路径及特征结构。 - 文件路径模板:LeRobot v3.0 使用
data/chunk-{chunk_index:03d}/file-{file_index:03d}.parquet和videos/{video_key}/chunk-{chunk_index:03d}/file-{file_index:03d}.mp4等模板。
应用建议
- 典型策略学习设置:
- 视觉观测:选取一个或多个
observation.images.*流。 - 本体感知:
observation.state。 - 可选触觉:
observation.tactile。 - 监督目标:
action。
- 视觉观测:选取一个或多个
- 多视图策略:建议从四路视觉流(头部左、头部右、左腕、右腕)开始,再按需加入触觉视频流。
- 实验拆分:建议按季节进行训练/评估集的拆分,避免同一采集会话内的演示混合。




