登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
krishan-CSE/Davidson_Hate_Speeh_and_EA
krishan-CSE/Davidson_Hate_Speeh_and_EA
收藏
Hugging Face
2024-05-08 更新
2024-06-12 收录
仇恨言论检测
极端言论分类
数据链接:
https://hf-mirror.com/datasets/krishan-CSE/Davidson_Hate_Speeh_and_EA
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
许可证:Apache 2.0
应用场景:
提供机构:
krishan-CSE
原始信息汇总
数据集许可证信息
许可证类型
:Apache-2.0
相关数据集
Paul/hatecheck-mandarin
仇恨言论检测
多语言处理
Multilingual HateCheck (MHC) 是一个用于检测10种不同语言中仇恨言论的功能测试套件,包括阿拉伯语、荷兰语、法语、德语、印地语、意大利语、普通话、波兰语、葡萄牙语和西班牙语。每种语言包含25+个功能测试,对应于不同类型的仇恨和具有挑战性的非仇恨内容,从而提供针对模型性能的定向诊断见解。
Hugging Face
2022-07-05 更新
43
0
APEACH
仇恨言论检测
语言模型评估
APEACH数据集是由Kakao Corp.等机构合作创建的,专注于韩国仇恨言论检测。该数据集包含约3770条实例,涵盖了多样化的主题和句子长度,旨在通过用户生成的内容减少与预训练语料库的词汇重叠,从而更准确地评估模型性能。创建过程中,采用了匿名付费工作者生成有毒表达的方式,并通过任务管理器进行后标记,确保数据质量。APEACH数据集的应用领域主要集中在评估预训练语言模型在仇恨言论检测中的性能,特
arXiv
2022-10-26 更新
20
0
vpmoreira/offcombr
仇恨言论检测
文本分类
OffComBR是一个用于检测巴西网络新闻评论中仇恨言论的注释数据集,包含葡萄牙语的文本和标签(no和yes)。数据集有两个配置(offcombr-2和offcombr-3),每个配置都有训练集,分别包含1250和1033个样本。
Hugging Face
2024-01-18 更新
13
0
mapsoriano/2016_2022_hate_speech_filipino
仇恨言论检测
菲律宾语文本
该数据集包含27,383条推文,标记为仇恨言论(1)或非仇恨言论(0),并按照80-10-10的比例分为训练集、验证集和测试集。数据集结合了[hate_speech_filipino]和2022年菲律宾总统选举相关推文的新数据集。数据集中仇恨和非仇恨推文的数量几乎平衡。数据集主要由菲律宾语文本组成,辅以一些在2016和2022年菲律宾国家/总统选举期间常用的英语单词。
Hugging Face
2024-07-13 更新
32
0
hate-speech-filipino/hate_speech_filipino
仇恨言论检测
自然语言处理
--- annotations_creators: - machine-generated language_creators: - crowdsourced language: - tl license: - unknown multilinguality: - monolingual size_categories: - 10K<n<100K source_datasets: - extend
Hugging Face
2024-01-18 更新
16
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广