遇见数据集

Senqiao/LiDAR-LLM-Nu-Caption

收藏
Hugging Face2024-12-24 更新2025-02-15 收录
官方服务:

资源简介:

nu-Caption数据集是一个为自动驾驶场景中的标题任务设计的问答数据集,用于训练机器学习语言模型。它基于NuScenes数据集构建,并提供了两种不同的输出:一种是VLM模型使用图像数据生成的输出,另一种是GPT4O-mini过滤后仅使用LiDAR模态信息的输出。

The nu-Caption dataset is a QA dataset designed for training MLLM models on caption tasks in autonomous driving scenarios. It is built upon the NuScenes dataset and provides two different types of outputs: one generated by VLM models using image data, and the other filtered by GPT4O-mini to use only LiDAR modality information.

提供机构:
Senqiao
搜集汇总
数据集介绍
Senqiao/LiDAR-LLM-Nu-Caption 数据集图片
背景与挑战
背景概述
该数据集是一个基于NuScenes构建的自动驾驶场景问答数据集,专门用于训练多模态大语言模型在字幕任务上的性能。它包含视觉和LiDAR模态的问答对,其中'answer_lidar'字段经过过滤,适用于纯LiDAR模态的训练,如LiDAR-LLM模型,旨在探索大语言模型在3D LiDAR理解方面的潜力。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务