登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
COCOVQA
COCOVQA
收藏
OpenXLab
2026-04-18 收录
视觉问答
多模态理解
数据链接:
https://openxlab.org.cn/datasets/OpenDataLab/COCOVQA
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
2017年4月: 完整版本 (2.0版) 平衡真实图像 204,721可可图像 (所有当前列车/val/测试) 1,105,904问题 11,059,040地面真相答案
应用场景:
提供机构:
OpenDataLab
创建时间:
2023-06-27
相关数据集
HSPACE (Human-SPACE)
3D人体传感
虚拟现实
目前,3d 人体传感技术的进步受到缺乏具有 3d 地面实况的视觉数据集的限制,包括多人,在运动中,在现实世界环境中操作,具有复杂的照明或遮挡,并可能被移动相机。复杂的场景理解需要估计人体姿势和形状以及手势,以实现最终将有用的度量和行为信号与自由视点照片般逼真的可视化能力相结合的表示。为了保持进步,我们构建了一个大型逼真的数据集 Human-SPACE (HSPACE),其中包含放置在复杂合成室内和
OpenDataLab
2026-07-12 更新
10
0
Polish Political Advertising Dataset
政治广告分析
自然语言处理
用于检测波兰语中特定文本块和政治广告类别的数据集。它包含 1,705 条人工注释的推文,标记有九个类别,这些类别构成波兰选举法下的竞选活动。
OpenDataLab
2026-08-23 更新
6
0
SARA motion (Synthetic Actors and Real Actions)
3D人体运动合成
动作相似性推理
Sara motion 是一个名为 Synthetic Actors and Real Actions (SARA) 的 3D 运动数据集,用于训练模型以生成适合推理运动相似性的运动嵌入。 该数据集的运动序列数据是通过组合 18 个不同的演员(即执行动作的角色)生成的。使用 Adobe Fuse 软件将角色渲染成骨架形状。选择了四个动作类别(战斗、冒险、运动和舞蹈),包括许多动作变化,其中每个动作
OpenXLab
3
0
SLMLAH/ar_vqaradmed_instruct
视觉问答
机器学习
该数据集包含图像和对话内容。图像特征为图像类型,对话特征为一个列表,包含内容和角色两个字段,均为字符串类型。数据集仅包含一个训练集,共有2248个样本,总大小为119592608字节,下载大小为46469167字节。
Hugging Face
2024-11-29 更新
8
0
2na-97/CoVAND
否定感知视觉定位
多模态理解
--- pretty_name: CoVAND Negation Grounding language: - en size_categories: - 10K<n<100K task_categories: - object-detection tags: - visual grounding - referring expression grounding - negation - multi
Hugging Face
2026-04-07 更新
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广