遇见数据集

dataset_env_starbuckswall9vegetabledistractor_task_pickcube_left_epi_10_ctrl_cartesian

收藏
Hugging Face2026-07-10 更新2026-07-10 收录
官方服务:

资源简介:

该数据集是使用LeRobot创建的,专为机器人任务设计。数据集包含10个训练片段,总计1682帧,涉及一个任务。数据采用panda机器人类型,以15帧每秒的速率采集。特征包括观察图像(主摄像头和腕部摄像头,分辨率为256x256,3通道,视频编码为av1)、状态观察(包括笛卡尔坐标、夹爪状态、关节状态和目标状态,共20个维度)和动作数据(7个维度,包括位置和夹爪控制)。数据文件总大小为100MB,视频文件总大小为200MB。数据集结构为parquet格式,分为训练集,并支持可视化。

提供机构:
cbrian
创建时间:
2026-07-10
原始信息汇总

数据集概述

  • 名称: cbrian/dataset_env_starbuckswall9vegetabledistractor_task_pickcube_left_epi_10_ctrl_cartesian
  • 许可证: Apache-2.0
  • 任务类别: 机器人学 (Robotics)
  • 标签: LeRobot
  • 创建工具: LeRobot (https://github.com/huggingface/lerobot)

数据集规模与结构

属性
总回合数 (episodes) 10
总帧数 (frames) 1682
总任务数 1
块大小 (chunks size) 1000
数据文件大小 100 MB
视频文件大小 200 MB
帧率 (fps) 15
分割 (splits) 训练集: 0:10 (全部)
  • 机器人类型: Panda
  • 数据文件路径格式: data/chunk-{chunk_index:03d}/file-{file_index:03d}.parquet
  • 视频文件路径格式: videos/{video_key}/chunk-{chunk_index:03d}/file-{file_index:03d}.mp4

数据特征 (Features)

每个帧包含以下特征,以字典形式组织:

特征名称 数据类型 形状 说明
observation.images.primary video [256, 256, 3] 主摄像头图像 (RGB),码率 AV1,30 fps,分辨率 256x256
observation.images.wrist video [256, 256, 3] 腕部摄像头图像 (RGB),码率 AV1,30 fps,分辨率 256x256
observation.state.cartesian float32 [6] 笛卡尔状态 (x, y, z, roll, pitch, yaw)
observation.state.gripper float32 [1] 夹爪状态
observation.state.joints float32 [7] 关节状态 (joint_0 至 joint_6)
observation.state.target float32 [6] 目标状态 (target_x, target_y, target_z, target_roll, target_pitch, target_yaw)
observation.state float32 [20] 合并状态 (笛卡尔+夹爪+关节+目标)
action float32 [7] 动作指令 (笛卡尔6维 + 夹爪)
timestamp float32 [1] 时间戳
frame_index int64 [1] 帧索引
episode_index int64 [1] 回合索引
index int64 [1] 全局索引
task_index int64 [1] 任务索引

可视化入口

二维码
社区交流群
二维码
科研交流群
商业服务