相关数据集
WildFake
WildFake数据集是由蚂蚁集团和上海交通大学清远研究院共同创建的,旨在评估AI生成图像检测的泛化性和鲁棒性。该数据集收集了来自开放源社区的大量假图像,涵盖了广泛的图像类别和风格。WildFake包含由不同类型的生成器(如GANs、扩散模型等)生成的图像,其层次结构设计有助于提升检测器的性能。此外,数据集还包含了真实图像,以确保检测器在多种实际场景中的有效性。WildFake的应用领域包括隐私保
arXiv2024-02-19 更新3920
Generated and Real Academic Corpus for Evaluation (GRACE)
GRACE数据集是一个用于检测学术论文是由AI生成还是人类撰写的多语言数据集,包含英语和阿拉伯语的人类撰写和AI生成的论文。数据集的设计旨在确保内容的多样性和真实性,涵盖了不同的学术水平和文化背景。人类撰写的论文主要来源于语言评估考试如IELTS和TOEFL,而AI生成的论文则使用了多种先进的LLM模型生成。该数据集的应用领域主要集中在学术诚信和AI生成文本检测,旨在解决AI生成文本在学术环境中的
arXiv2024-12-24 更新560
Job Application AI Detector & Authenticity Checker API
Detect AI-generated cover letters and get targeted interview questions instantly.
RapidAPI2026-05-06 更新170
MintVid
MintVid是由中国科学院与蚂蚁集团联合构建的高质量AI生成视频检测数据集,包含3000条视频样本,涵盖9种前沿生成模型。数据集分为三部分:1.5K高度逼真的专有模型生成视频(含文本/图像到视频内容)、2K基于3种公开模型的深度伪造视频,以及从短视频平台收集的真实场景含事实错误子集。其数据来源多样,覆盖通用内容、面部伪造和事实推理三大场景,旨在解决现有数据集时效性不足、时空一致性差等问题,为AI
arXiv2026-02-10 更新1260
AH&AITD – Arslan’s Human and AI Text Database
AH&AITD is a comprehensive benchmark dataset designed to support the evaluation of AI-generated text detection tools. The dataset contains 11,580 samples spanning both human-written
DataCite Commons2025-05-24 更新190



