遇见数据集

KVQA

收藏
arXiv2025-09-30 收录
官方服务:

资源简介:

该数据集是一个知识感知的视觉问答数据集,旨在测试模型在泛化和转移知识方面的能力。此外,该数据集还用于评估所提出方法在展现泛化能力方面的表现。其所涉及的任务是视觉问答。

This dataset is a knowledge-aware visual question answering (VQA) dataset designed to test models' abilities in generalization and knowledge transfer. Additionally, it is utilized to evaluate the performance of proposed methods when demonstrating generalization capabilities. The core task involved in this dataset is visual question answering (VQA).

搜集汇总
数据集介绍
KVQA 数据集图片
背景与挑战
背景概述
KVQA 是一个知识感知的视觉问答数据集,专注于回答涉及图像中命名实体的世界知识问题,填补了该领域的研究空白。该数据集包含 183K 问题-答案对、超过 18K 命名实体和 24K 图像,要求基于知识图谱进行多实体、多关系和跳数推理,是截至 2018 年最大的基于知识图谱的视觉问答数据集。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务