遇见数据集

FakeCovid- A Multilingual Cross domain Fact Check Dataset for COVID-19

收藏
Zenodo2021-04-28 更新2026-05-25 收录
数据链接:
官方服务:

资源简介:

FakeCovid is the first multilingual cross-domain dataset of 7623 fact-checked news articles for COVID-19, collected from 04/01/2020 to 01/07/2020. We have collected the fact-checked articles from 92 fact-checking websites after obtaining references from Poynter and Snopes. We have manually annotated the collected articles into 11 categories of the fact-checked news according to their content. We ultimately generated dataset is in 40 languages from 105 countries.

FakeCovid数据集是首个多语言跨领域新冠疫情事实核查新闻数据集,包含7623篇经事实核查的新闻文章,采集时段为2020年4月1日至2020年7月1日。我们在获取Poynter(波因特媒体研究所)与Snopes(斯努普斯事实核查网站)的参考资料后,从92家事实核查网站(fact-checking websites)收集了上述经事实核查的新闻文章。基于文章内容,我们对采集到的所有文章进行了人工标注,将其划分为11个事实核查新闻类别。最终构建的数据集覆盖40种语言,数据来自105个国家。

提供机构:
Zenodo
创建时间:
2020-07-29
二维码
社区交流群
二维码
科研交流群
商业服务