JoyAI-Image-OpenSpatial
收藏资源简介:
JoyAI-Image-OpenSpatial 是一个基于 OpenSpatial 构建的空间理解数据集,用于 JoyAI-Image 项目。数据集以 parquet 文件格式存储,包含以下字段:'conversations'(多轮对话对,包含人类提问和 GPT 回答,涉及相机参数和空间推理问题,以及结构化 3D 标注如 3D 边界框)、'id'(唯一样本标识符)、'data_source'(源数据集名称,如 arkitscenes、scannet、hypersim、Ego-Exo4D)、'images'(嵌入的 PNG 图像数据及原始路径)、'type'(数据类型标签)、'meta_info'(包含图像尺寸和调整信息的 JSON 字符串)。该数据集适用于空间理解和 3D 标注相关的任务。
JoyAI-Image-OpenSpatial is a spatial understanding dataset constructed based on OpenSpatial, designed for the JoyAI-Image project. The dataset is stored in Parquet file format and includes the following fields: "conversations": multi-turn dialogue pairs containing human queries and GPT responses, covering camera parameters, spatial reasoning problems, as well as structured 3D annotations such as 3D bounding boxes; "id": unique sample identifier; "data_source": source dataset name, e.g., arkitscenes, scannet, hypersim, Ego-Exo4D; "images": embedded PNG image data and original paths; "type": data type label; "meta_info": JSON string containing image dimensions and adjustment information. This dataset is applicable to tasks related to spatial understanding and 3D annotation.
JoyAI-Image-OpenSpatial 数据集概述
基本信息
- 许可证: Apache-2.0
- 任务类别: 视觉问答、图像到文本
- 语言: 英语
- 标签: 空间理解、3D视觉、深度估计、3D基础、多视图
- 规模类别: 1M<n<10M
- 配置名称: default
- 数据文件: train 分割,路径为
data/*.parquet - 下载大小: 2362232012800 字节
- 数据集大小: 2362232012800 字节
数据集详情
- 描述: 基于 OpenSpatial 构建的空间理解数据集,用于 JoyAI-Image。
- 样本数量: 训练集包含 2,335,335 个样本。
- 数据来源: 涵盖 9 个源数据集,包括 ARKitScenes, ScanNet, ScanNet++, HyperSim, Matterport3D, WildRGB-D, 和 Ego-Exo4D。
- 任务范围: 覆盖广泛的空间理解能力,包括 3D 物体基础、深度排序、空间关系推理、距离估计等。
- 数据状态: 剩余的网页数据将在未来版本中开源。
数据特征
数据集包含以下特征列:
- conversations: 列表类型,包含多轮对话对(
human/gpt)。human回合提供相机参数和空间推理问题;gpt回合提供结构化的空间标注(例如,3D 边界框、深度排序、空间关系)。 - id: 字符串类型,唯一样本标识符。
- data_source: 字符串类型,源数据集名称(例如
arkitscenes,scannet,scannetpp,hypersim,matterport3d,wildrgbd,Ego-Exo4D)。 - images: 列表类型,包含嵌入的图像数据(PNG 字节)和路径。
- type: 字符串类型,数据类型标签。
- meta_info: 字符串类型,包含图像尺寸(
width,height,resized_width,resized_height)的 JSON 字符串。
快速开始
使用以下代码加载数据集: python from datasets import load_dataset ds = load_dataset("jdopensource/JoyAI-Image-OpenSpatial", split="train", streaming=True) for sample in ds: print(sample["conversations"]) break
待办事项
- 发布 3D 提升数据。




