combined_targets_eval
收藏资源简介:
该数据集是使用LeRobot框架创建的机器人数据集,旨在为机器人模仿学习、行为克隆和强化学习提供训练数据。数据集包含57个演示片段(episodes),共28777帧,覆盖5个不同任务。机器人类型为stringman。数据字段包括:11维动作(包含线速度、角速度、腕部速度、手指速度、接触向量和episode结束标志)、9维观测状态(夹爪位置、旋转角度、手指角度、激光测距仪、手指压力、腕部角度和目标力)、两个摄像头视频流(夹爪摄像头:256x448分辨率,顶置摄像头:512x512分辨率,均为30fps,AV1编码),以及时间戳、帧索引、episode索引、任务索引等元数据。数据以Parquet文件和MP4视频文件形式存储,训练集包含所有57个episodes。
This dataset is a robot dataset created using the LeRobot framework, designed to provide training data for robot imitation learning, behavior cloning, and reinforcement learning. It contains 57 demonstration episodes with a total of 28,777 frames, covering 5 different tasks. The robot type is stringman. Data fields include: 11-dimensional action (including linear velocity, angular velocity, wrist velocity, finger velocity, contact vector, and episode end flag), 9-dimensional observation state (gripper position, rotation angle, finger angle, laser rangefinder, finger pressure, wrist angle, and target force), two camera video streams (gripper camera: 256x448 resolution, overhead camera: 512x512 resolution, both at 30fps, AV1 codec), as well as metadata such as timestamps, frame indices, episode indices, and task indices. Data is stored in Parquet files and MP4 video files, with the training set containing all 57 episodes.
数据集概述
数据集名称:naavox/combined_targets_eval
数据集简介:该数据集使用 LeRobot 框架创建,主要面向机器人学(robotics)任务,属于机器人操控相关数据。
基本信息
| 属性 | 内容 |
|---|---|
| 许可证 | Apache-2.0 |
| 任务类别 | 机器人学(robotics) |
| 标签 | LeRobot |
| 机器人类型 | stringman |
| 帧率(fps) | 30 |
| 代码库版本 | v3.0 |
数据规模
| 指标 | 数值 |
|---|---|
| 总片段数(total_episodes) | 57 |
| 总帧数(total_frames) | 28,777 |
| 总任务数(total_tasks) | 5 |
| 数据文件大小 | 100 MB |
| 视频文件大小 | 200 MB |
| 数据切分 | train: 0:57(全部作为训练集) |
数据特征(Features)
1. 动作(action)
- 数据类型:float32
- 维度:11
- 特征字段:
vel_x、vel_y、vel_z:速度分量(x/y/z)room_vel_x、room_vel_y:房间速度分量wrist_speed:手腕速度finger_speed:手指速度contact_vec_x、contact_vec_y、contact_vec_z:接触向量分量episode_end:片段结束标志
2. 观测状态(observation.state)
- 数据类型:float32
- 维度:9
- 特征字段:
gripper_pos_x、gripper_pos_y、gripper_pos_z:夹爪位置坐标spin:旋转角度finger_angle:手指角度laser_rangefinder:激光测距值finger_pressure:手指压力wrist_angle:手腕角度target_force:目标力
3. 图像观测(observation.images)
(a)夹爪相机(gripper_camera)
- 分辨率:256 × 448 × 3(高 × 宽 × 通道)
- 视频编码:AV1,帧率 30 fps
- 像素格式:yuv420p
- 类型:普通彩色视频(非深度图)
(b)顶视相机(overhead_camera)
- 分辨率:512 × 512 × 3(高 × 宽 × 通道)
- 视频编码:AV1,帧率 30 fps
- 像素格式:yuv420p
- 类型:普通彩色视频(非深度图)
- 编码参数:CRF=30,预设值=12
4. 时间戳(timestamp)
- 数据类型:float32,维度 1
5. 帧索引(frame_index)
- 数据类型:int64,维度 1
6. 片段索引(episode_index)
- 数据类型:int64,维度 1
7. 索引(index)
- 数据类型:int64,维度 1
8. 任务索引(task_index)
- 数据类型:int64,维度 1
数据格式与存储
- 数据文件路径:
data/*/*.parquet(按块组织和存储) - 视频文件路径:
videos/{video_key}/chunk-{chunk_index:03d}/file-{file_index:03d}.mp4 - 块大小:1000
使用说明
- 该数据集可通过 LeRobot 框架进行加载和使用。
- 数据集提供可视化工具,可通过 Hugging Face Spaces 上的 LeRobot 数据集可视化工具进行预览。
- 目前论文信息(Paper)和引用格式(BibTeX)尚未提供(标记为 "More Information Needed")。




