10万小时多场景第一人称视角(Ego-Centric)具身智能数据,在多种真实场景下,以第一人称视角采集的人类操作数据,每条数据包含:①时间对齐的双目视频、②双目相机参数、③3D场景重建的点云文件、④人体关节数据、⑤分步骤的语义标注文件。该数据集可用于具身智能大模型的训练。