登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Performance comparison results on VQA 2.0 dataset.
Performance comparison results on VQA 2.0 dataset.
收藏
NIAID Data Ecosystem
2026-03-14 收录
视觉问答性能评估
多模态模型
数据链接:
https://figshare.com/articles/dataset/Performance_comparison_results_on_VQA_2_0_dataset_/21634624
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Performance comparison results on VQA 2.0 dataset.
应用场景:
创建时间:
2022-11-28
相关数据集
Common Objects Out-of-Context (COOCO)
多模态模型
视觉语言模型
COOCO数据集是一个用于评估多模态模型在场景上下文中整合对象级和场景级视觉信息能力的全新数据集。该数据集包含18,395张图像,分为原始图像、低、中、高相关性和同类型目标条件。数据集通过在COCO-Search18数据集的基础上引入与场景类型具有不同程度语义相关性的目标对象来构建,旨在研究视觉语言模型在场景语义违规情况下的行为。该数据集可用于评估模型在不同场景上下文和视觉噪声条件下对目标对象识别
arXiv
2025-06-27 更新
96
0
WildVision/PublicBenchHub
多模态模型
基准测试
这是一个多模态大型语言模型的公共基准集合,包括MMMU和TouchStone等,用于随机数据样本在WildVision Arena中的测试。
Hugging Face
2024-02-22 更新
42
0
自动驾驶-复杂城市场景多模态感知与决策数据集
自动驾驶感知
多模态模型
数据集数据来源主要为车企合作方提供原始数据,场景细节包含复杂城市的拥堵路况、交叉路口、雨天/夜间等特殊工况;数据集所属领域为交通运输、智能驾驶;标注方式分为视觉标注数据、激光雷达标注数据、毫米波雷达标注数据以及多模态融合标注数据;数据总存储容量累计为125TB;产出的高质量数据集聚焦自动驾驶领域,为自动驾驶算法优化提供高质量数据支撑。
国家数据集管理服务平台
2026-05-09 更新
25
0
lmms-lab/NoCaps
图像描述
多模态模型
该数据集是[NoCaps](https://nocaps.org/)的一个格式化版本,用于`lmms-eval`管道中以一键评估大型多模态模型。数据集包含图像及其相关元数据,如URL、捕获日期、文件名、尺寸、ID、许可证信息等,以及注释ID和注释标题。数据集分为验证集和测试集,分别包含4500和10600个样本。
Hugging Face
2024-03-08 更新
80
0
Multi-Image Relational Benchmark (MIRB)
多图像理解
多模态模型
Multi-Image Relational Benchmark (MIRB) 是由爱丁堡大学和同济大学共同创建的数据集,旨在评估视觉语言模型在多图像理解方面的能力。该数据集包含925个样本,涵盖感知、视觉世界知识、推理和多跳推理四个维度,每个样本至少需要处理2张图像。MIRB的创建过程涉及从多个来源独立收集图像,并设计了一系列需要跨图像比较和分析的任务。该数据集的应用领域广泛,包括但不限于机器人
arXiv
2024-06-19 更新
37
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广