Objectron
收藏资源简介:
Objectron是一个包含短的对象中心视频片段的数据集,每个视频片段都伴随有AR会话元数据,包括相机姿态、稀疏点云和平面。数据集包含约15K个标注视频片段和4M个标注图像,涵盖自行车、书籍、瓶子、相机、谷物盒、椅子、杯子、笔记本电脑和鞋子等多个类别。此外,数据集还提供了3D对象检测解决方案,用于鞋、椅、杯和相机四个类别的对象。
Objectron is a dataset comprising short object-centric video clips, each accompanied by AR session metadata, including camera poses, sparse point clouds, and planes. The dataset contains approximately 15K annotated video clips and 4M annotated images, covering multiple categories such as bicycles, books, bottles, cameras, cereal boxes, chairs, cups, laptops, and shoes. Additionally, the dataset provides 3D object detection solutions for objects in four categories: shoes, chairs, cups, and cameras.
数据集概述
数据集名称
Objectron Dataset
数据集描述
Objectron是一个包含短对象中心视频片段及其姿态标注的集合。每个视频中,相机围绕对象移动,从不同角度捕捉对象。数据集包含15,000个标注视频和超过400万标注图像,涵盖以下类别:自行车、书籍、瓶子、相机、谷物盒、椅子、杯子、笔记本电脑和鞋子。此外,为确保地理多样性,数据集从全球10个国家收集。
关键特性
- 包含15,000个标注视频和400万标注图像
- 所有样本包含高分辨率图像、对象姿态、相机姿态、点云和平面
- 提供多种tf.record格式的即用示例,适用于TensorFlow/PyTorch
- 对象中心多视角,从不同角度观察同一对象
- 精确的评估指标,如用于定向3D边界框的3D IoU
数据集格式
数据存储在Google Cloud存储的objectron桶中。数据集包括:
- 视频序列
- 包含3D边界框的对象标注标签
- AR元数据,如相机姿态、点云和平面表面
- 处理后的数据集,包括分片和洗牌的tf.records和视频的tf.SequenceExample格式
- 支持脚本,用于基于3D IoU的评估和数据加载
数据集大小
原始数据集大小为1.9TB,总数据集大小为4.4TB。
类别统计
| 类别 | 视频数量 | 帧数 |
|---|---|---|
| 自行车 | 476 | 150k |
| 书籍 | 2024 | 576k |
| 瓶子 | 1928 | 476k |
| 相机 | 815 | 233k |
| 谷物盒 | 1609 | 396k |
| 椅子 | 1943 | 488k |
| 杯子 | 2204 | 546k |
| 笔记本电脑 | 1473 | 485k |
| 鞋子 | 2116 | 557k |
教程
- 数据集下载
- TensorFlow示例加载
- PyTorch数据加载
- 原始标注文件解析
- AR元数据解析
- 模型性能评估(3D IoU)
- SequenceExample教程
- NeRF模型训练
许可证
Objectron数据集根据Computational Use of Data Agreement 1.0 (C-UDA-1.0)发布。




