遇见数据集

RoboLab-BananaInBowl-hard-base-stoch-260802

收藏
Hugging Face2026-08-09 更新2026-08-02 收录
官方服务:

资源简介:

来自RoboLab(Isaac Lab)的`BananaInBowl`策略的RL rollout,在**`hard`**初始姿态分布下,导出用于pi0.5 delta-action SFT。

来自RoboLab(Isaac Lab)的`BananaInBowl`策略的强化学习(Reinforcement Learning, RL)滚动推演,在**`hard`**初始姿态分布下,导出用于pi0.5增量动作(delta-action)的监督微调(Supervised Fine-Tuning, SFT)。

提供机构:
DAVIAN-Robotics
创建时间:
2026-08-02
原始信息汇总

数据集概述:RoboLab-BananaInBowl-hard-base-stoch-260802

基本信息

  • 数据集名称: RoboLab-BananaInBowl-hard-base-stoch-260802
  • 许可证: Apache-2.0
  • 数据集地址: https://huggingface.co/datasets/DAVIAN-Robotics/RoboLab-BananaInBowl-hard-base-stoch-260802
  • 创建工具: 使用 LeRobot 框架创建

数据集来源与背景

  • 目的: 来自 RoboLab(Isaac Lab)环境中 BananaInBowl 任务的强化学习(RL)策略采样数据,专门为 pi0.5 delta-action 监督微调(SFT)导出。
  • 采集策略: 名为 ipl-bana-hard-s0 的 RFCL 代理,采用反向→正向转换阈值 solved_frac_threshold = 0.9(正向阶段在反向课程中 45/50 个演示被解决后开始)。
  • 策略性能: 最终评估成功率为 0.98,平均成功情节长度为 47.7 步。
  • ⚠️ 重要对比注意事项: 另一个独立赛道(banana-hard-sf50)使用 solved_frac_threshold = 0.5 从头训练,其产生数据集不可与此数据集互换。如果要进行受控对照实验,请勿混合使用。

初始姿态分布(hard)

  • 位置: 使用任务测量可行范围的 100%
  • 偏航: 在 ±180° 范围内均匀分布(全圆)
  • 物体固定: 名称包含 bin 的容器保持固定;包括 bowl 在内的其他资产随目标一起随机化
  • 布局来源: 来自预生成且经过物理验证的布局数据集(DAVIAN-Robotics/robolab-init-positions),确保不存在初始穿透物体
  • 偏航存储: 使用绝对偏航角(已包含场景默认方向)

记录约定

字段 约定
手臂动作 DROID 坐标系下的绝对关节目标(j7 偏移 -π/4)
夹爪动作 二进制值 {0, 1}(原始值 > 0 表示闭合)
状态 完整关节向量(遥操作原生)
成功判定 K-保持稳定,success_hold_steps = 15,成功时截断情节
相机 over_shoulder_left_camerawrist_cam
帧率 15 fps

注意: 夹爪为二进制是关键特性。早期版本记录了连续夹爪,导致对下游策略质量的高估。请勿从中重新推导连续通道。

数据处理

  • q01/q99 分位数统计存储在 meta/stats.json 中(pi0.5 分位数归一化所需),且在聚合后计算,非按分片计算。
  • 所有视频为恒定帧率(CFR),已通过归一化处理消除 PTS 抖动,确保 torchcodec 后端正确读取(每个视频有单一 PTS 增量)。

数据集内容

  • 数据采集方式: 从策略分布中采样(温度 1.0),另有一个确定性(argmax)版本独立发布。
  • 情节筛选: 仅包含成功情节,失败情节在采集时被丢弃。

规模统计

  • 总情节数: 5941
  • 总帧数: 433699
  • 总任务数: 1 个
  • 数据分割: 训练集(全部 5941 个情节)
  • 数据文件大小: 约100MB(parquet 文件)
  • 视频文件大小: 约200MB(视频文件)

数据结构(features)

  • action: 8 维 float32,包含 7 个关节(j0-j6)+ 1 个夹爪(gripper),15 fps
  • observation.state: 8 维 float32,包含 8 个关节(joint_0 至 joint_7),15 fps
  • observation.velocity: 8 维 float32,15 fps
  • observation.images.over_shoulder_left_camera: 视频,270×480×3,15 fps
  • observation.images.wrist_cam: 视频,270×480×3,15 fps
  • 其他字段: episode_index、frame_index、index、task_index、timestamp、next.done(bool)
  • 视频格式: avc1 编码,yuv420p 像素格式,无音频

许可与引用

  • 数据来源: 完全在模拟环境中合成生成,无第三方录音
  • 引用信息: 目前暂无可用引用格式(BibTeX 为 [More Information Needed])
二维码
社区交流群
二维码
科研交流群
商业服务