DVD
收藏资源简介:
DVD数据集是由新加坡管理大学和Facebook合作开发的视频基础对话数据集,包含1099250个问题-答案对。该数据集通过合成11000个视频,每个视频生成10个回合的对话,每个回合包含多个问题,用于测试对话系统在视频内容理解和多步推理方面的能力。DVD数据集设计有最小偏差,并详细标注了不同类型的空间-时间推理,适用于分析现有对话系统的性能和局限性。该数据集的应用领域包括视频理解和对话系统,旨在解决视频基础对话中的复杂推理问题。
The DVD dataset is a video-grounded dialogue dataset jointly developed by Singapore Management University and Facebook, encompassing 1,099,250 question-answer pairs. This dataset is created by synthesizing 11,000 videos, each associated with 10 rounds of dialogue where each round contains multiple questions. It is designed to evaluate the capabilities of dialogue systems in video content understanding and multi-step reasoning. The DVD dataset is engineered with minimal bias and features detailed annotations for various types of spatio-temporal reasoning, making it suitable for analyzing the performance and limitations of existing dialogue systems. Its application domains cover video understanding and dialogue systems, aiming to address complex reasoning challenges in video-grounded dialogue tasks.
DVD数据集概述
数据集简介
DVD(Diagnostic Dataset for Video-grounded Dialogues)是一个用于视频基础对话中多步骤推理的诊断数据集。该数据集旨在减少模型可以利用的偏差,并通过详细的注释来分析对话系统在视频时空空间上的不同推理类型。
数据集构成
DVD数据集包含11,000个CATER合成视频,每个视频有10个10轮对话实例,总计超过100,000个对话和100万个问答对。
数据集统计
| 分割 | 视频数量 | 对话数量 | 问题数量 | 唯一问题数量 |
|---|---|---|---|---|
| DVD-Train | 6,157 | 61,551 | 615,510 | 360,334 |
| DVD-Val | 1,540 | 15,396 | 153,960 | 99,211 |
| DVD-Test | 3,299 | 32,978 | 329,780 | 200,346 |
| DVD-Total | 10,996 | 109,925 | 1,099,250 | 620,739 |
数据集结构
数据集包括两个主要部分:
dvd_dialogues:包含训练、验证和测试分割的所有对话。dvd_resnext101:包含所有CATER视频的提取ResNext101特征。
数据集下载
数据集可从这里下载。
数据集使用
数据集的使用包括以下步骤:
- 预处理CATER视频。
- 生成对话和注释。
- 加载和批处理数据集。
数据探索
提供了一个笔记本用于展示如何从DVD对话中提取不同的注释。

- DVD技术首次由东芝和索尼公司联合推出,标志着数字视频光盘技术的诞生。
- DVD播放器开始在全球范围内商业化销售,迅速成为家庭娱乐的主流设备。
- DVD-ROM驱动器开始集成到个人电脑中,使得DVD成为存储和播放多媒体内容的重要媒介。
- DVD刻录技术成熟,用户可以自行刻录DVD光盘,进一步扩展了DVD的应用领域。
- 蓝光光盘技术推出,标志着新一代高清视频存储技术的兴起,逐渐取代了部分DVD市场。



