mimicgen_three_piece_assembly_d0_224x224
收藏资源简介:
这是一个MimicGen ThreePieceAssembly_D0任务的演示数据集,采用LeRobot v3格式,两个相机渲染为224x224分辨率。数据集包含1000个episode,共336695帧,帧率20,机器人使用Panda,采用OSC_POSE控制,控制频率20。相机包括agentview和eye_in_hand,均为224x224,AV1编码crf30。observation.state维度为51,由9维本体感受和42维特权物体维度组成。注意:该任务演示并非全部成功,1000个演示中有18个从未达到完全奖励,298个在最后帧前达到后又失去,因此success在episode内和episode间变化。来源:基于NVIDIA发布的core/three_piece_assembly_d0.hdf5,仅重新渲染了相机图像,其他列直接复制。模式:遵循chomeed/mimicgen_coffee_d0_224x224的约定。
This is a demonstration dataset for the MimicGen ThreePieceAssembly_D0 task, in LeRobot v3 format, with two cameras rendered at 224x224 resolution. The dataset contains 1000 episodes, totaling 336,695 frames, at 20 fps. The robot is Panda, controlled with OSC_POSE at 20 Hz. Cameras include agentview and eye_in_hand, both at 224x224, AV1 encoded with CRF 30. observation.state dimension is 51, consisting of 9 proprioceptive and 42 privileged object dimensions. Note: not all demonstrations are successful; among the 1000, 18 never achieve full reward, and 298 achieve it but then lose it before the final frame, so success varies within and across episodes. Source: derived from NVIDIAs core/three_piece_assembly_d0.hdf5, with only camera images re-rendered; other columns are directly copied. Convention: follows the chomeed/mimicgen_coffee_d0_224x224 format.
数据集概述:mimicgen_three_piece_assembly_d0_224x224
该数据集是MimicGen框架下ThreePieceAssembly_D0任务在LeRobot v3格式下的演示数据集,所有摄像头画面均以224x224分辨率重新渲染。数据集遵循与chomeed/mimicgen_coffee_d1_224x224相同的处理流程和约定。
基本信息
| 属性 | 值 |
|---|---|
| 任务 | ThreePieceAssembly_D0(三件装配) |
| 演示次数 | 1000 |
| 总帧数 | 336,695 |
| 帧率 | 20 FPS |
| 机器人 | Panda(OSC_POSE控制,控制频率20Hz) |
| 摄像头 | agentview、eye_in_hand(224x224分辨率,AV1编码,CRF 30) |
| 状态维度 | 51维 = 9维本体感觉 + 42维特权物体信息 |
| 许可证 | CC-BY-4.0 |
数据来源与生成方式
数据集基于NVIDIA发布的core/three_piece_assembly_d0.hdf5文件(源自amandlek/mimicgen_datasets)构建。由于源文件仅包含84x84分辨率的图像,本数据集仅对摄像头画面进行了重渲染,具体做法为:将每帧记录的states向量写回实时ThreePieceAssembly_D0环境,以224x224分辨率重新渲染两个摄像头视角。其余所有列均直接从源HDF5文件复制,因此属于重渲染而非重模拟,未重放任何动力学过程。
保真度验证:将演示0以源文件自身84x84分辨率重渲染后,与存储图像对比,平均绝对差异为FIDELITY_3P。微小残差源于原始数据在不同OpenGL栈上渲染。
数据模式说明
observation.state(51维):由robot0_eef_pos、robot0_eef_quat、robot0_gripper_qpos和object拼接而成,前9维为本体感觉信息,后42维为特权物体信息。仅取前9维即可作为仅本体感觉的策略输入。observation.sim_state(58维):可回放至实时ThreePieceAssembly_D0环境。success == done == (reward >= 1.0)。source_demo_index == episode_index:表示该演示在源HDF5中的索引。is_first/is_last/is_terminal:仅标记一个回合的首帧和末帧。
任务特性说明
该任务的演示并非全部成功:1000个演示中,18个从未达到完全奖励,298个达到后又在最后一帧前失去奖励,因此success在回合内和回合间均存在真实变化。



