libero_unified_nvidia
收藏资源简介:
LIBERO统一版(NVIDIA LeRobot v3)是一个合并了所有四个NVIDIA LIBERO_LeRobot_v3套件(libero_10、libero_goal、libero_object、libero_spatial)的单一LeRobot v3数据集,具有全局语言键任务索引(0-39)。它适用于非语言多任务模仿学习模型。数据集包含1693个片段、273465帧、40个任务,帧率为20 FPS,使用Franka机器人,提供observation.images.image和observation.images.wrist_image两个摄像头视角。
LIBERO Unified (NVIDIA LeRobot v3) is a single LeRobot v3 dataset that merges all four NVIDIA LIBERO_LeRobot_v3 suites (libero_10, libero_goal, libero_object, libero_spatial) with a global language key task index (0-39). It is suitable for non-language multi-task imitation learning models. The dataset contains 1693 episodes, 273465 frames, 40 tasks, at 20 FPS, using the Franka robot, with two camera views: observation.images.image and observation.images.wrist_image.
LIBERO Unified (NVIDIA LeRobot v3) 数据集详情
数据集概述
LIBERO Unified 是一个面向机器人操作任务的多任务模仿学习数据集,将 NVIDIA 提供的四个 LIBERO LeRobot v3 子数据集合并为单一 LeRobot v3 格式数据集,并采用全局语言键控任务索引(0–39),适用于非语言的多任务模仿学习模型训练。
数据来源
数据集由以下四个 NVIDIA 套件合并而成:
| 套件名称 | 角色 |
|---|---|
libero_10 |
长时程任务(10个任务) |
libero_goal |
目标导向套件(10个任务) |
libero_object |
物体操作套件(10个任务) |
libero_spatial |
空间推理套件(10个任务) |
数据基于 nvidia/LIBERO_LeRobot_v3 构建,采用本地合并方式,视频文件直接复制而非重新编码。
主要修改
- 合并四个套件文件夹为一个 LeRobot 根目录结构(包含
meta/、data/、videos/)。 - 任务索引重新映射:将各套件局部的
0–9索引重新映射为全局0–39索引,按自然语言指令进行键控(与HuggingFaceVLA/libero顺序一致)。 - 保持 20 FPS 帧率,包含
observation.images.image和observation.images.wrist_image两个摄像头视角,机器人类型为franka。
若不进行全局重映射,各套件局部的任务 ID 会发生冲突(例如空间任务0 ≠ 物体任务0)。
任务索引布局
| 索引范围 | 所属套件 |
|---|---|
| 0–9 | libero_10 |
| 10–19 | libero_goal |
| 20–29 | libero_object |
| 30–39 | libero_spatial |
评估时,可通过 (suite_name, env.task_id) 映射到仿真语言,再映射至相同的全局 ID。
数据统计
- 回合数(Episodes): 1693
- 总帧数(Frames): 273465
- 任务数(Tasks): 40
- 帧率(FPS): 20
数据结构
数据集采用 LeRobot v3.0 格式,包含以下特征字段:
图像特征
observation.images.image:主摄像头图像,尺寸 256×256×3(RGB),视频编码为 AV1,帧率 20 FPS,像素格式 yuv420p。observation.images.wrist_image:腕部摄像头图像,尺寸 256×256×3(RGB),视频编码为 AV1,帧率 20 FPS,像素格式 yuv420p。
状态与动作特征
observation.state:机器人状态,float32 类型,维度 8,包含 x、y、z、轴角(3个)以及夹爪(2个)信息。action:机器人动作,float32 类型,维度 7,包含 x、y、z、轴角(3个)以及夹爪信息。
元数据特征
timestamp:float32 类型,时间戳。frame_index:int64 类型,帧索引。episode_index:int64 类型,回合索引。index:int64 类型,全局索引。task_index:int64 类型,任务索引(全局 0–39)。
数据存储信息
- 数据路径:
data/chunk-{chunk_index:03d}/file-{file_index:03d}.parquet - 视频路径:
videos/{video_key}/chunk-{chunk_index:03d}/file-{file_index:03d}.mp4 - 数据文件大小: 约 100 MB
- 视频文件大小: 约 200 MB
- 数据集划分: 仅包含训练集(
train: 0:1693)
许可证
数据集采用 Apache-2.0 许可证。



