image-verification-corpus
收藏资源简介:
这是一个不断更新的数据集,包含社交媒体(目前是Twitter)中分享的假和真图像。数据集的目的是开发一个开放的语料库,用于评估在线图像验证方法(基于推文文本和用户特征)和构建新内容的分类器(目前是包含图像的推文)。
This is a continuously updated dataset comprising both fake and genuine images shared on social media platforms (currently Twitter). The dataset aims to develop an open corpus for evaluating online image verification methods (based on tweet text and user characteristics) and constructing classifiers for new content (currently tweets containing images).
数据集概述
数据集名称
image-verification-corpus
数据集目的
该数据集旨在开发一个开放的语料库,用于评估在线图像验证方法(基于推文文本和用户特征)以及构建新内容的分类器(目前为包含图像的推文)。
数据集组成
数据集包含以下四个文件:
- set_images.txt
- 包含已通过在线来源验证的假和真图像。
- 包含字段:image_id(图像参考ID)、image_url(图像在线URL)、annotation(图像真实性声明)、event(图像来源事件)。
- tweets_images.txt
- 包含用于构建数据集的推文及其包含的图像。
- 包含字段:tweet_id(推文ID)、image_id(关联图像的参考ID)、annotation(推文真实性声明)、event(推文来源事件)。
- tweets_images_update.txt
- 仅包含来自前一文件的纯假推文。
- 已移除内容有趣的推文或声明内容为假的推文。
- tweets_event.txt
- 包含使用过的含有假内容的推文,但这些推文已不再在线可获取。
使用指南
使用该语料库时,只需使用set_images.txt文件与已验证的图像,以及上述其他包含推文的文件之一。
引用信息
若使用此数据集进行研究,请引用以下文献:
- Boididou, C., Papadopoulos, S., Zampoglou, M., Apostolidis, L., Papadopoulou, O., & Kompatsiaris, Y. (2018). Detection and visualization of misleading content on Twitter. International Journal of Multimedia Information Retrieval, 7(1), 71-86.
@article{boididou2018detection,
author = {Boididou, Christina and Papadopoulos, Symeon and Zampoglou, Markos and Apostolidis, Lazaros and Papadopoulou, Olga and Kompatsiaris, Yiannis},
title = {Detection and visualization of misleading content on Twitter},
journal = {International Journal of Multimedia Information Retrieval},
volume={7},
number={1},
pages={71--86},
year={2018},
doi = "10.1007/s13735-017-0143-x",
publisher={Springer}
}




