数据链接:
官方服务:
资源简介:
#StopAsianHate 2021 dataset, Rong Wang
应用场景:
创建时间:
2023-01-14
相关数据集
ProvocationProbe
ProvocationProbe是一个旨在探索引发仇恨言论与一般仇恨言论区别的数据集,由印度理工学院鲁尔分校、莱布尼茨社会科学研究所和塔尔图大学共同创建。该数据集包含约27,000条从Twitter收集的推文,涵盖了九个全球争议事件,涉及种族、政治和宗教等多个主题。数据集的创建过程包括从Twitter收集数据、使用Google Perspective API进行预处理和手动标注。该数据集主要用于研
arXiv2024-10-26 更新3820
nayeon212/CREHate
CREHate是一个跨文化的英语仇恨言论数据集,旨在解决单一语言内文化多样性在仇恨言论检测中的不足。该数据集通过两个步骤构建:1) 文化帖子收集,2) 跨文化注释。数据来源于SBIC数据集和四个地理上分散的英语国家(澳大利亚、英国、新加坡和南非),并收集了来自这些国家及美国的注释以建立每个国家的代表性标签。数据集包含1,580个帖子,每个帖子由来自五个国家的注释者进行注释,共产生7,900个标签。
Hugging Face2024-06-24 更新200
PANDA – Paired Anti-hate Narratives Dataset from Asia
PANDA数据集是首个专注于中文反仇恨言论的语料库,由佛罗里达大学和Lingua的研究团队创建。该数据集包含2974条仇恨言论与反仇恨言论的配对数据,旨在解决中文社交媒体中仇恨言论的对抗问题。数据来源包括多个开源中文仇恨言论数据集,如COLD、SWSR和CHSD。通过使用LLM-as-a-Judge和模拟退火算法生成反仇恨言论,并经过人工验证,确保数据的质量和上下文相关性。该数据集为中文反仇恨言论
arXiv2025-01-05 更新390



