M3DBench
收藏资源简介:
M3DBench引入了一个全面的3D指令跟随数据集,支持交错的多模态提示,覆盖了现实世界3D环境中的各种基本能力。此外,M3DBench提供了一个新的基准,用于评估大型模型在以3D视觉为中心的任务上的表现。
M3DBench introduces a comprehensive 3D instruction-following dataset that supports interleaved multimodal prompts, covering a variety of fundamental capabilities in real-world 3D environments. Additionally, M3DBench provides a new benchmark for evaluating the performance of large models on 3D vision-centric tasks.
数据集概述
数据集名称
M3DBench
数据集描述
M3DBench是一个综合性的3D指令遵循数据集,支持交错的多模态提示,涵盖了现实世界3D环境中的多种基本能力。该数据集具有以下特点:
- 支持文本、图像、3D对象和其他视觉提示的通用多模态指令。
- 统一了区域和场景级别的多样化3D任务。
- 包含超过320,000个指令-响应对,是一个大规模的3D指令遵循数据集。
数据集用途
用于评估大型模型在理解多模态3D提示方面的性能,并支持一般的3D中心任务。
数据集规模
包含超过320,000个指令-响应对。
数据集特点
- 支持多模态指令,包括文本、图像、3D对象等。
- 统一了多种3D任务,覆盖区域和场景级别。
- 用于建立新的基准,评估大型模型在3D视觉任务中的表现。
引用信息
{bibtex} @misc{li2023m3dbench, title={M3DBench: Lets Instruct Large Models with Multi-modal 3D Prompts}, author={Mingsheng Li and Xin Chen and Chi Zhang and Sijin Chen and Hongyuan Zhu and Fukun Yin and Gang Yu and Tao Chen}, year={2023}, eprint={2312.10763}, archivePrefix={arXiv}, primaryClass={cs.CV} }




