Senqiao/LiDAR-LLM-Nu-Caption
收藏官方服务:
资源简介:
nu-Caption数据集是一个为自动驾驶场景中的标题任务设计的问答数据集,用于训练机器学习语言模型。它基于NuScenes数据集构建,并提供了两种不同的输出:一种是VLM模型使用图像数据生成的输出,另一种是GPT4O-mini过滤后仅使用LiDAR模态信息的输出。
The nu-Caption dataset is a QA dataset designed for training MLLM models on caption tasks in autonomous driving scenarios. It is built upon the NuScenes dataset and provides two different types of outputs: one generated by VLM models using image data, and the other filtered by GPT4O-mini to use only LiDAR modality information.
提供机构:
Senqiao搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集是一个基于NuScenes构建的自动驾驶场景问答数据集,专门用于训练多模态大语言模型在字幕任务上的性能。它包含视觉和LiDAR模态的问答对,其中'answer_lidar'字段经过过滤,适用于纯LiDAR模态的训练,如LiDAR-LLM模型,旨在探索大语言模型在3D LiDAR理解方面的潜力。
以上内容由遇见数据集搜集并总结生成



