B1k_Rollouts
收藏资源简介:
B1k_Rollouts 是基于 BEHAVIOR-1K 基准的策略 rollout 数据集,采用 modality-first 布局。数据集包含六个主要模态:data(每个 episode 的 parquet 文件)、meta(episode 的 JSON 和 BDDL 转换文件、谓词目录)、trajectories(每个 episode 的 HDF5 轨迹)、videos(每个 episode 的六路相机流,包括 RGB 和深度图像,来自 head、left_wrist、right_wrist 视角)、judgement(每个 episode 的原语级时间线报告和种子 JSON)、logs(复合视频 MP4、每个 episode 的摘要 JSON、原始客户端评估日志)。此外,顶层 index.csv 文件记录了每个 episode 的元信息:episode_id、task_id、instance_id、idx、outcome(成功/失败)、success(布尔值)、n_steps、fps、has_judgement、has_composite。数据集包含多个任务,每个任务有不同数量的 episode:task-0031(clean_boxing_gloves,500 episodes,成功率34%)、task-0005(setting_mousetraps,498 episodes,成功率12%)、task-0000(turning_on_radio,655 episodes,成功率47%)、task-0001(picking_up_trash,499 episodes,成功率27%)、task-0003(cleaning_up_plates_and_food,496 episodes,成功率18%)、task-0010(set_up_a_coffee_station_in_your_kitchen,498 episodes,成功率2%)。每个 episode 均包含所有六路相机流(RGB 和深度),部分任务还包含 judgement 报告和复合视频。注意事项:episode id 存在溢出问题,不应从 id 前四位推断任务;部分任务的 logs 是本地生成的而非原始捕获;q_score 字段在所有指标文件中为 null 且不可恢复;部分 episode 缺少 judgement 报告;task-0001 存在重复 episode 且仅保留成功版本;task-0000 的 judgement 格式不同;task-0010 为最难任务;所有任务均有完整的六路相机流,其中部分任务通过服务器端复制补全了深度流。
B1k_Rollouts is a policy rollout dataset based on the BEHAVIOR-1K benchmark, adopting a modality-first layout. The dataset consists of six main modalities: data (parquet files for each episode), meta (JSON and BDDL conversion files for episodes, predicate directory), trajectories (HDF5 trajectories for each episode), videos (six camera streams for each episode, including RGB and depth images from head, left_wrist, and right_wrist views), judgement (primitive-level timeline reports and seed JSON for each episode), and logs (composite video MP4, summary JSON for each episode, original client evaluation logs). Additionally, the top-level index.csv file records meta-information for each episode: episode_id, task_id, instance_id, idx, outcome (success/failure), success (boolean), n_steps, fps, has_judgement, has_composite. The dataset contains multiple tasks, each with a varying number of episodes: task-0031 (clean_boxing_gloves, 500 episodes, 34% success rate), task-0005 (setting_mousetraps, 498 episodes, 12% success rate), task-0000 (turning_on_radio, 655 episodes, 47% success rate), task-0001 (picking_up_trash, 499 episodes, 27% success rate), task-0003 (cleaning_up_plates_and_food, 496 episodes, 18% success rate), task-0010 (set_up_a_coffee_station_in_your_kitchen, 498 episodes, 2% success rate). Each episode includes all six camera streams (RGB and depth), and some tasks also include judgement reports and composite videos. Notes: episode IDs have overflow issues, so tasks should not be inferred from the first four digits of the ID; logs for some tasks are locally generated rather than original captures; the q_score field is null in all metric files and cannot be recovered; some episodes lack judgement reports; task-0001 has duplicate episodes with only the successful version retained; judgement format is different for task-0000; task-0010 is the most difficult task; all tasks have complete six-view camera streams, with some tasks having depth streams completed via server-side replication.
B1k_Rollouts 数据集概述
基本信息
- 许可证: Apache-2.0
- 任务类别: 机器人学 (robotics)
- 标签: behavior-1k, robot-rollouts
数据集结构
该数据集采用模态优先的布局设计,共包含六个顶层文件夹,每个模态文件夹下按任务(task-NNNN/)组织数据:
| 模态 | 内容 |
|---|---|
data/ |
每集情节的 parquet 文件 |
meta/ |
每集情节的 JSON 文件、BDDL 转换文件及谓词目录 |
trajectories/ |
每集情节的 HDF5 轨迹文件 |
videos/ |
每集情节的 6 路相机流(RGB 和深度:头部、左手腕、右手腕) |
judgement/ |
每集情节的基础时间线报告(Markdown)和种子文件 |
logs/ |
合成视频(1080×360)、每集摘要指标及评估日志 |
根目录下的 index.csv 记录每集情节的元数据,包含 episode_id, task_id, instance_id, idx, outcome, success, n_steps, fps, has_judgement, has_composite 字段。
任务统计
| 任务 | 情节数 | 成功率 | 失败数 | 含判断报告数 |
|---|---|---|---|---|
| task-0031(清理拳击手套) | 500 | 170(34%) | 330 | 363 |
| task-0005(设置捕鼠器) | 498 | 58(12%) | 440 | 341 |
| task-0000(打开收音机) | 655 | 311(47%) | 344 | 2 |
| task-0001(捡垃圾) | 499 | 136(27%) | 363 | 470 |
| task-0003(清理盘子和食物) | 496 | 88(18%) | 408 | 41 |
| task-0010(在厨房设置咖啡站) | 498 | 11(2%) | 487 | 232 |
重要注意事项
情节 ID 溢出问题
demo_id = task*10000 + instance*10,当 instance 达到 1000 时会产生 ID 溢出,导致 ID 前四位无法反映真实任务编号。不能仅凭情节 ID 前四位推断任务,必须使用 index.csv 中的 task_id 或 meta 文件中的 task_name 字段。
数据来源与覆盖率差异
- task-0031 和 task-0005:
logs/目录为本地生成,非录制数据(task-0005 为真实的录制输出) - task-0001: 部分情节有重复 rollout,仅保留成功尝试;
logs/覆盖率不完整(440 个合成视频、289 个指标文件对应 499 个情节) - task-0000: 判断数据为另一代生成,基本缺失(仅 2 个情节有标准报告);另有 16 个按步骤标注的文件存于
annotations/目录 - task-0010: 成功率仅为 2%(11/498),为最低,但数据完整(所有情节都有六路相机流、合成视频和指标文件)
- task-0003: 判断数据稀疏且包含截图(仅 41/496 个情节有报告/种子对);
logs/metrics覆盖 215/496,合成视频覆盖全部 496
数据完整性说明
q_score字段为 null:由于 BDDL 目标中缺少Covered谓词,该字段不可恢复,应以success和n_steps为准- 全任务均含完整六路相机流:task-0005、task-0000 和 task-0001 的深度流是后来补传的(服务器端复制)
- 未迁移的上游文件:task-0000 的
recovery_hdf5/、recovery_lerobot/、restore_states/、rollout_success/及 task-0001 的fallback_recovery_*、rollout_success/、task_1_training_bank.npz均保留在上游仓库 - task-0003 数据:直接从 fastwalker1118/b1k-task5-mousetraps 通过跨仓库 LFS 复制迁移,内容与上游字节一致
- 孤儿数据:task-0000 中存在 4 个产生日志但无对应情节数据的 idx 目录,以及 1 个额外的谓词目录(对应未记录的溢出版本 instance_0000)




