登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
DB files generated from MSRVTT-QA dataset
DB files generated from MSRVTT-QA dataset
收藏
kaggle
2026-05-11 更新
2026-06-17 收录
视频问答
多模态理解
数据链接:
https://www.kaggle.com/datasets/rakinaljubair/dbs-files
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
DB files generated from MSRVTT-QA dataset (45 videos)
基于含45个视频的MSRVTT-QA数据集生成的数据库文件
应用场景:
创建时间:
2026-05-11
相关数据集
AGQA-Decomp
视频问答
问题分解
最近的视频问题回答基准表明,最先进的模型难以回答组成问题。但是,尚不清楚哪种类型的组成推理会导致模型错误预测。此外,很难辨别模型是使用组成推理还是利用数据偏差得出答案。在本文中,我们开发了一个问题分解引擎,该引擎以编程方式将组成问题解构为子问题的有向无环图。该图的设计使每个父问题都是其子级的组成。我们介绍了AGQA-decompp,这是一个包含2.3M个问题图的基准,每个图平均有11.49个子问题
OpenDataLab
2026-07-12 更新
56
0
ucf-crcv/ImplicitQA
视频问答
隐式推理
ImplicitQA数据集是一个专门为测试视频问答中的隐式推理任务而设计的新型基准。它包含了1000个精心注释的问答对,这些问答对来自320个高质量的创意视频片段。与现有的主要关注显性视觉内容(如单个帧或短片段中的动作、对象、事件)的视频问答基准不同,ImplicitQA专注于模型在动机、因果关系以及跨非连续帧关系的推理能力。这个数据集模拟了人类对创意和电影式视频的理解,这些视频通常采用省略某些描
Hugging Face
2025-11-06 更新
7
0
WueNLP/mvl-sib
多模态理解
多语言信息检索
MVL-SIB是一个大规模多语言视觉-语言数据集,包含205种语言的图像-句子对,分为7个主题类别,用于跨模态主题匹配任务。
Hugging Face
2025-03-12 更新
6
0
weikaih/TaskMeAnything-v1-videoqa-random
视频问答
任务生成器
TaskMeAnything-v1-videoqa-random是一个从TaskMeAnything-v1中随机抽取问题的数据集,包含2,700个VideoQA问题。数据集分为9个不同的任务生成器,每个生成器包含300个问题。每个数据条目包括视频、问题、选项、答案及其对应的任务计划。由于Huggingface不支持直接保存.mp4文件,视频以二进制流的形式保存,加载后可以转换为.mp4格式。
Hugging Face
2024-06-09 更新
33
0
MSRVTT-MC
视频问答
自然语言处理
该数据集是一个视频问答的基准测试,其中包含了多项选择题。它用于评估模型在多项选择格式下的表现能力,任务是视频问题回答。
arXiv
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广