aloha_incontext
收藏资源简介:
aloha_incontext数据集是vo2yager/aloha_data_unique数据集的重新组织版本,与ContextFlow论文的训练和测试任务列表保持一致。包含1,349个episodes、31个任务配置和595,900帧数据,其中25个seen配置(1,318个episodes)和6个unseen配置(31个episodes)。数据来自Mobile ALOHA机器人,使用双手机械臂(14自由度),配备3个RGB摄像头(cam_high、cam_left_wrist、cam_right_wrist),分辨率为480×640,采集频率为50 fps。动作空间为16维(14个关节目标+2个基础速度维度);状态观察为14维。
The aloha_incontext dataset is a reorganized version of the vo2yager/aloha_data_unique dataset, aligned with the training and testing task lists from the ContextFlow paper. It includes 1,349 episodes, 31 task configurations, and 595,900 frames, with 25 seen configurations (1,318 episodes) and 6 unseen configurations (31 episodes). The data is sourced from the Mobile ALOHA robot, which uses a dual-arm setup (14 degrees of freedom) equipped with 3 RGB cameras (cam_high, cam_left_wrist, cam_right_wrist) at a resolution of 480×640 and a collection frequency of 50 fps. The action space is 16-dimensional (14 joint targets + 2 base velocity dimensions); the state observations are 14-dimensional.
数据集概览:aloha_incontext
- 许可证:Apache-2.0
- 任务类别:机器人学(Robotics)
- 标签:LeRobot、mobile_aloha、模仿学习
- 数据格式:Parquet 文件
核心统计
- 总集数:1,349 集
- 任务配置:31 种
- 总帧数:595,900 帧
- 训练/测试划分:
- 已见配置(Seen):25 种,共 1,318 集
- 未见配置(Unseen):6 种,共 31 集
数据内容
- 机器人平台:Mobile ALOHA,双臂 14 自由度(DoF)
- 传感器:
- 3 个 RGB 摄像头(
cam_high、cam_left_wrist、cam_right_wrist),分辨率为 480×640 - 帧率:50 fps
- 3 个 RGB 摄像头(
- 动作空间:16 维(14 个关节目标 + 2 个基座速度维度)
- 状态空间:14 维(
observation.state)
与源数据集的关系
该数据集是对 vo2yager/aloha_data_unique 的重新组织,并非新增数据。所有图像列通过往返比较验证为字节一致。仅重写了三个管理列(episode_index、task_index 和全局行计数器 index)。主要变更包括:
- 合并:将同一配置的批次合并为一个任务(如
pen_uncap_gray_left_b5与_b9合并为 143 集) - 删除:移除了论文中未涉及的 15 个任务(138 集),包括四个
separate_cups任务、pen_uncap_blue_left_b5以及 10 个单演示的拾取放置任务 - 重命名:任务名称采用自然语言指令而非文件夹名
手部命名约定
笔帽任务名称遵循论文约定,其中 <left>/<right> 表示拿起笔的手,与源数据集的命名方式相反(源数据集以盖笔帽的手命名)。拾取放置任务的手部标签与源数据集一致。
| 本数据集中的任务 | 源任务 | 集数 |
|---|---|---|
...用右手拿起灰色笔... |
pen_uncap_gray_left_b5 + _b9 |
143 |
...用左手拿起灰色笔... |
pen_uncap_gray_right_b5 |
51 |
...用右手拿起红色笔... |
pen_uncap_red_left_b9 + _b5 |
69 |
...用左手拿起蓝色笔... |
pen_uncap_blue_right_b5 |
25 |
...用右手拿起第二支蓝色笔... |
pen_uncap_blue2_left_b5 |
25 |
...用左手拿起第二支蓝色笔... |
pen_uncap_blue2_right_b5 |
25 |
...用左手拿起红色笔... (未见) |
pen_uncap_red_right_b5 |
22 |
四种双臂配置(handover、cup_stack、stir、water_wipe)保留简短文件夹名。
数据划分
数据集仅包含一个 train 划分,已见/未见配置通过任务名称区分。6 种未见配置为:
- 用左手拿起梨并放入篮子
- 用左手拿起橙汁并放入篮子
- 用右手拿起猕猴桃并放入篮子
- 用右手拿起香蕉并放入篮子
- 用左手拿起红色笔,另一只手抓住笔盖并打开
- 用右手拿起红色鸡蛋,放入盒子并合上盒子
排除这些后,剩余的训练集恰好为论文报告的 1,318 集。
其他说明
meta/stats.json中的数值特征基于这 1,349 集重新计算,每通道的图像统计信息与源数据集保持一致- 在
aloha_data_unique上训练的模型无法直接与本次数据集对比,因为训练分布和归一化统计数据均不同



