登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
CHOICE
CHOICE
收藏
kaggle
2025-03-18 更新
2025-05-03 收录
遥感图像理解
视觉语言模型基准测试
数据链接:
https://www.kaggle.com/datasets/anxiaowhu/choice
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Benchmarking the Remote Sensing Capabilities of Large Vision-Language Models
评估大型视觉-语言模型的遥感能力基准测试
应用场景:
创建时间:
2025-03-18
相关数据集
xiang709/VRSBench
遥感图像理解
视觉语言模型
VRSBench是一个用于遥感图像理解的多功能视觉-语言基准数据集。它包含29,614张遥感图像,每张图像都有详细的描述,52,472个对象引用,以及3,123,221个视觉问答对。这些数据支持广泛的遥感图像理解任务的训练和评估。数据集通过多个数据工程步骤构建,包括属性提取、提示工程、GPT-4推理和人工验证。此外,数据集还支持模型训练,展示了LVMs在遥感图像理解中的潜力,并讨论了数据集的社会影
Hugging Face
2024-07-10 更新
369
0
VRSBench
遥感图像理解
多任务学习
VRSBench是由阿卜杜拉国王科技大学创建的一个大型多任务遥感图像理解数据集,包含29,614张图像,每张图像配有详细的人工验证描述、52,472个对象引用和123,221个问答对。数据集通过半自动数据收集流程创建,包括属性提取、提示工程、GPT-4推理和人工验证,确保高质量和大规模。VRSBench旨在推动遥感领域中视觉-语言模型的发展,支持图像描述、视觉定位和视觉问答等多种任务,解决现有数据
arXiv
2024-06-18 更新
153
0
Voxel51/NaviTrace
具身导航评估
视觉语言模型基准测试
NaviTrace是一个视觉问答基准数据集,用于评估视觉语言模型在真实场景中具身导航理解的能力。每个样本包含一张第一人称视角的户外环境图像和一条自然语言导航指令,任务是根据给定的具身类型(人类、腿式机器人、轮式机器人或自行车)预测一个二维导航轨迹(图像空间中的一系列路径点)。数据集包含1002个场景,提供超过3000条专家标注的轨迹,涵盖多种导航挑战类别,如几何地形、语义地形、可访问性、可见性、社
Hugging Face
2026-05-26 更新
10
0
RS-GPT4V
遥感图像理解
多模态处理
RS-GPT4V是由中南大学开发的统一多模态指令遵循数据集,专为遥感图像理解设计。该数据集结合了GPT-4V和现有数据集,通过问题-回答对形式统一了任务,如描述、定位等。数据集旨在训练模型理解复杂场景和进行高级视觉推理,包含91,937个训练图像和991,206个问题-回答对,以及15,999个测试图像和258,419个问题-回答对。RS-GPT4V的应用领域广泛,包括图像描述、视觉问答和复杂场景
arXiv
2024-06-18 更新
189
0
OmniGameArena
游戏智能体评测
视觉语言模型基准测试
OmniGameArena是由多机构联合创建的一个综合性基准测试数据集,旨在系统评估视觉语言模型在游戏环境中的智能体表现。该数据集包含12款全新构建的虚幻引擎5游戏,涵盖单人、玩家对战与合作三种模式,数据来源于定制开发的游戏实例,确保了评估场景的新颖性和低预训练污染风险。数据集的创建过程涉及精心设计游戏机制、视觉资产整合以及统一动作接口的开发,以支持异构智能体的公平比较。其核心应用领域是推进视觉语
arXiv
2026-06-09 更新
16
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广