相关数据集
geoQA
GeoQA是一个视觉问答数据集,包含问题、选项、答案以及相关评论等字段。数据集分为训练集,大小约为33MB,共有5010个示例。数据集的任务是针对地理相关的视觉问题进行回答。
Hugging Face2025-05-31 更新320
UCSC-Admire/idiom-dataset-7-2024-11-10_01-26-17
--- dataset_info: features: - name: id dtype: int32 - name: compound dtype: string - name: sentence_type dtype: string - name: sentence dtype: string - name: image_1_prompt
Hugging Face2024-11-10 更新130
UCSC-VLAA/MedVLThinker-pmc_vqa-gpt_4o_reasoning-tokenized
这是一个包含图像和文本的问答数据集,其中文本部分包括问题、选项和答案。数据集被划分为训练集,共有67158个样本。数据集还包含了推理信息和样本通过次数等信息。
Hugging Face2025-08-15 更新70
krutrim-ai-labs/IndicPope
IndicPope是一个用于评估大型视觉语言模型在视觉问答任务上的数据集,特别针对简单的是非问题(例如,图片中是否有车?)。该数据集基于POPE,并使用负采样技术来测试随机、流行和对抗性设置下的视觉语言模型中的对象幻觉。数据集包含8.91k个样本,涵盖12种印度语言和英语。
Hugging Face2025-03-05 更新130
道路类型-路口内道路
库帕思联合智能汽车创新发展平台公司,对外公开自动驾驶通用高质量L4数据集10个,覆盖10大类场景、70个标签(天气、时间、光照条件、动态交互场景、道路等级、道路类型、交通情况、交通参与者、交通基础设施、道路障碍物)。本样例数据为道路类型-路口内道路的数据。
库帕思2026-04-01 更新70



