遇见数据集

libero_unified_nvidia

收藏
Hugging Face2026-08-21 更新2026-08-21 收录
官方服务:

资源简介:

LIBERO统一版(NVIDIA LeRobot v3)是一个合并了所有四个NVIDIA LIBERO_LeRobot_v3套件(libero_10、libero_goal、libero_object、libero_spatial)的单一LeRobot v3数据集,具有全局语言键任务索引(0-39)。它适用于非语言多任务模仿学习模型。数据集包含1693个片段、273465帧、40个任务,帧率为20 FPS,使用Franka机器人,提供observation.images.image和observation.images.wrist_image两个摄像头视角。

LIBERO Unified (NVIDIA LeRobot v3) is a single LeRobot v3 dataset that merges all four NVIDIA LIBERO_LeRobot_v3 suites (libero_10, libero_goal, libero_object, libero_spatial) with a global language key task index (0-39). It is suitable for non-language multi-task imitation learning models. The dataset contains 1693 episodes, 273465 frames, 40 tasks, at 20 FPS, using the Franka robot, with two camera views: observation.images.image and observation.images.wrist_image.

提供机构:
lambdavi
创建时间:
2026-08-21
原始信息汇总

LIBERO Unified (NVIDIA LeRobot v3) 数据集详情

数据集概述

LIBERO Unified 是一个面向机器人操作任务的多任务模仿学习数据集,将 NVIDIA 提供的四个 LIBERO LeRobot v3 子数据集合并为单一 LeRobot v3 格式数据集,并采用全局语言键控任务索引(0–39),适用于非语言的多任务模仿学习模型训练。

数据来源

数据集由以下四个 NVIDIA 套件合并而成:

套件名称 角色
libero_10 长时程任务(10个任务)
libero_goal 目标导向套件(10个任务)
libero_object 物体操作套件(10个任务)
libero_spatial 空间推理套件(10个任务)

数据基于 nvidia/LIBERO_LeRobot_v3 构建,采用本地合并方式,视频文件直接复制而非重新编码。

主要修改

  1. 合并四个套件文件夹为一个 LeRobot 根目录结构(包含 meta/data/videos/)。
  2. 任务索引重新映射:将各套件局部的 0–9 索引重新映射为全局 0–39 索引,按自然语言指令进行键控(与 HuggingFaceVLA/libero 顺序一致)。
  3. 保持 20 FPS 帧率,包含 observation.images.imageobservation.images.wrist_image 两个摄像头视角,机器人类型为 franka

若不进行全局重映射,各套件局部的任务 ID 会发生冲突(例如空间任务0 ≠ 物体任务0)。

任务索引布局

索引范围 所属套件
0–9 libero_10
10–19 libero_goal
20–29 libero_object
30–39 libero_spatial

评估时,可通过 (suite_name, env.task_id) 映射到仿真语言,再映射至相同的全局 ID。

数据统计

  • 回合数(Episodes): 1693
  • 总帧数(Frames): 273465
  • 任务数(Tasks): 40
  • 帧率(FPS): 20

数据结构

数据集采用 LeRobot v3.0 格式,包含以下特征字段:

图像特征

  • observation.images.image:主摄像头图像,尺寸 256×256×3(RGB),视频编码为 AV1,帧率 20 FPS,像素格式 yuv420p。
  • observation.images.wrist_image:腕部摄像头图像,尺寸 256×256×3(RGB),视频编码为 AV1,帧率 20 FPS,像素格式 yuv420p。

状态与动作特征

  • observation.state:机器人状态,float32 类型,维度 8,包含 x、y、z、轴角(3个)以及夹爪(2个)信息。
  • action:机器人动作,float32 类型,维度 7,包含 x、y、z、轴角(3个)以及夹爪信息。

元数据特征

  • timestamp:float32 类型,时间戳。
  • frame_index:int64 类型,帧索引。
  • episode_index:int64 类型,回合索引。
  • index:int64 类型,全局索引。
  • task_index:int64 类型,任务索引(全局 0–39)。

数据存储信息

  • 数据路径: data/chunk-{chunk_index:03d}/file-{file_index:03d}.parquet
  • 视频路径: videos/{video_key}/chunk-{chunk_index:03d}/file-{file_index:03d}.mp4
  • 数据文件大小: 约 100 MB
  • 视频文件大小: 约 200 MB
  • 数据集划分: 仅包含训练集(train: 0:1693

许可证

数据集采用 Apache-2.0 许可证。

二维码
社区交流群
二维码
科研交流群
商业服务