AV-Deepfake1M++
收藏资源简介:
AV-Deepfake1M++是一个包含200万视频片段的大型数据集,用于音频-视觉深度伪造检测和定位任务。该数据集从VoxCeleb2、LRS3和EngageNet三个不同的源数据集中获取,并包含了多样化的操纵策略和音频-视觉扰动。数据集的创建过程包括使用九种最先进的模型进行深度伪造生成,并集成了15种视频级和11种音频级的失真。该数据集在2025年ACM多媒体会议上举办了1M-Deepfakes Detection Challenge。
AV-Deepfake1M++ is a large-scale dataset containing 2 million video clips, designed for audio-visual deepfake detection and localization tasks. This dataset is sourced from three distinct datasets: VoxCeleb2, LRS3, and EngageNet, and encompasses diverse manipulation strategies and audio-visual perturbations. The dataset creation process involves generating deepfakes using nine state-of-the-art models, and integrates 15 video-level and 11 audio-level distortions. This dataset supported the 1M-Deepfakes Detection Challenge held at the 2025 ACM International Conference on Multimedia (ACM MM).
2025 1M-Deepfakes Detection Challenge 数据集概述
数据集基本信息
- 名称:2025 1M-Deepfakes Detection Challenge
- 主办方:ACM Multimedia 2025
- 数据集版本:AV-Deepfake1M++
- 样本数量:超过200万
挑战任务
任务1:视频级深度伪造检测
- 任务描述:给定包含单个说话者的视听样本,判断视频是深度伪造还是真实的。
任务2:深度伪造时间定位
- 任务描述:给定包含单个说话者的视听样本,找出进行篡改的时间戳[start, end]。
- 任务假设:从传播错误信息的角度出发。
相关资源
- GitHub:https://github.com/deepfakes1m
- Hugging Face:https://huggingface.co/deepfakes1m
- 联系邮箱:deepfakes1mchallenge@gmail.com




