CobotMagic_打开冰箱数据集
收藏资源简介:
# Open the Refrigerator Dataset for CobotMagic 这是一个面向 AgileX CobotMagic / Mobile ALOHA 双臂机器人的“打开冰箱”操作数据集。数据按照采集批次独立保存;两个批次使用相同的任务、机器人类型和数据格式,但不会合并为同一个 `chunk`。 ## 数据集概览 | 项目 | 内容 | | --- | --- | | 任务 | `open the refrigerator` | | 机器人 | `mobile_aloha` | | 数据格式 | LeRobot v2.1 风格 Parquet + JSON/JSONL 元数据 | | 帧率 | 30 FPS | | 批次 | 2 | | 总 episode 数 | 61 | | 总帧数 | 31,000 | | 总任务数 | 1 | | 状态维度 | 14 | | 动作维度 | 14 | | 独立视频文件 | 当前本地上传目录中为 0;每批通过 `videos/.gitkeep` 保留对称目录 | ## 批次说明 ### `batch_001` 第一批数据,来自 `open_the_refrigerator_v21`: - 30 个 episodes - 18,600 帧 - 30 个 Parquet 文件 - 1 个任务 - 数据路径:`batch_001/data/chunk-000/episode_*.parquet` - 元数据:`batch_001/meta/` ### `batch_002` 独立的新采集批次,来自 `open_the_refrigerator_half_v21`,相比于第一批没有开完冰箱回正的动作: - 31 个 episodes - 12,400 帧 - 31 个 Parquet 文件 - 1 个任务 - 数据路径:`batch_002/data/chunk-000/episode_*.parquet` - 元数据:`batch_002/meta/` `batch_002` 保持自己的 `chunk-000`,没有重命名为 `chunk-001`,也没有并入 `batch_001`。 ## 文件组织 ```text . ├── README.md ├── batch_001 │ ├── data │ │ └── chunk-000 │ │ └── episode_*.parquet │ ├── meta │ │ ├── episodes.jsonl │ │ ├── episodes_stats.jsonl │ │ ├── info.json │ │ └── tasks.jsonl │ └── videos │ └── .gitkeep └── batch_002 ├── data │ └── chunk-000 │ └── episode_*.parquet ├── meta │ ├── episodes.jsonl │ ├── episodes_stats.jsonl │ ├── info.json │ └── tasks.jsonl └── videos └── .gitkeep ``` 两个批次分别包含三类独立目录:`data/`、`meta/` 和 `videos/`。本地输入中没有独立的 MP4 文件,因此 `videos/` 仅包含用于保留目录结构的 `.gitkeep` 标记文件;所有已有 Parquet、JSON 和 JSONL 文件均仅进行了目录移动,文件内容未修改。 ## 观测与控制字段 每个 Parquet 文件遵循对应批次 `meta/info.json` 中声明的 v2.1 schema,主要字段包括: - `observation.state`:14 维双臂关节状态 - `observation.velocity`:14 维双臂关节速度 - `observation.effort`:14 维双臂关节力矩/努力值 - `action`:14 维双臂控制动作 - `observation.images.cam_high`:`3 × 480 × 640` RGB 图像观测 - `observation.images.cam_left_wrist`:`3 × 480 × 640` RGB 图像观测 - `observation.images.cam_right_wrist`:`3 × 480 × 640` RGB 图像观测 - `timestamp`、`frame_index`、`episode_index`、`index`、`task_index` 关节字段顺序为: ```text left_waist, left_shoulder, left_elbow, left_forearm_roll, left_wrist_angle, left_wrist_rotate, left_gripper, right_waist, right_shoulder, right_elbow, right_forearm_roll, right_wrist_angle, right_wrist_rotate, right_gripper ``` ## 在 ModelScope 中预览和加载 README 顶部的 YAML 配置注册了两个子数据集: - `batch_001`:默认配置,`train` split 对应 `batch_001/data/**/*.parquet` - `batch_002`:`train` split 对应 `batch_002/data/**/*.parquet` 上传后可以在 ModelScope 预览页面分别选择两个配置。使用 ModelScope SDK 时,可按批次选择: ```python from modelscope.msdatasets import MsDataset batch_001 = MsDataset.load( "Str0keOOOO/Open_the_Refrigerator_Dataset_for_CobotMagic", subset_name="batch_001", split="train", ) batch_002 = MsDataset.load( "Str0keOOOO/Open_the_Refrigerator_Dataset_for_CobotMagic", subset_name="batch_002", split="train", ) ``` ## 数据完整性说明 - 未修改任何 Parquet 文件内容。 - 未修改任何 JSON 或 JSONL 文件内容。 - 未将第二批数据改写为第一批的 `chunk-001`。 - 两个批次拥有独立的 `data/`、`meta/`、`videos/` 目录。 - 两批元数据分别保存在自己的 `meta/` 目录中。 ## 许可与使用 本数据集的具体许可协议、数据采集授权和使用限制以仓库维护者在 ModelScope 页面公布的信息为准。使用者应遵守机器人数据、视频/图像数据以及 ModelScope 平台的相关条款。



