登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Italian Hate Map Data
Italian Hate Map Data
收藏
Mendeley Data
2019-03-27 更新
2026-04-09 收录
仇恨言论检测
意大利语社交媒体分析
数据链接:
https://data.mendeley.com/datasets/5ky5fj7nnj
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Tweets gathered for the Italian Hate Map Project. Tweets are in Italian.
应用场景:
创建时间:
2019-03-27
相关数据集
APEACH
仇恨言论检测
语言模型评估
APEACH数据集是由Kakao Corp.等机构合作创建的,专注于韩国仇恨言论检测。该数据集包含约3770条实例,涵盖了多样化的主题和句子长度,旨在通过用户生成的内容减少与预训练语料库的词汇重叠,从而更准确地评估模型性能。创建过程中,采用了匿名付费工作者生成有毒表达的方式,并通过任务管理器进行后标记,确保数据质量。APEACH数据集的应用领域主要集中在评估预训练语言模型在仇恨言论检测中的性能,特
arXiv
2022-10-26 更新
20
0
Banglish (Bengali in English letter) Hate Speech Dataset
仇恨言论检测
多语言处理
This dataset contains Banglish comments for hate speech detection. It has 5000 comments in total. 2836 of these are hate speech, and 2164 are non-hate speech. Among the different types of hate speech
Mendeley Data
2024-03-27 更新
12
0
mestras-valcir/hatebr_gemma-3-1b-it_5shot_3exp
仇恨言论检测
大型语言模型评估
--- dataset_info: features: - name: idx dtype: int32 - name: sentence dtype: string - name: label dtype: class_label: names: '0': non-offensive '1
Hugging Face
2025-04-11 更新
10
0
hatexplain
仇恨言论检测
可解释人工智能
Hatexplain是一个用于可解释仇恨言论检测的基准数据集,它涵盖了仇恨言论问题的多个方面。数据内容包括英文文本,规模为1万到10万条样本。每条帖子都从三个不同的角度进行标注:基本的3类分类(仇恨、冒犯或正常)、目标群体(帖子中仇恨/冒犯言论的受害者)以及理由(标注决策所依据的帖子部分)。数据采集自Twitter和Gab,经过了标准化处理,并通过众包方式进行标注。Hatexplain支持文本分类
OpenCSG
2024-07-19 更新
14
0
Silly-Machine/TuPy-Dataset
仇恨言论检测
自然语言处理
TuPy数据集是一个包含10,000条葡萄牙语推文的数据集,专门设计用于训练和测试仇恨言论检测模型。数据集分为二元分类和多标签分类,每个分类下都有训练集和测试集。数据集中的文本已经过匿名处理,确保用户身份的隐私。标注过程采用投票机制,确保分类的准确性。数据集详细记录了包括年龄歧视、种族歧视、性别歧视等在内的多种仇恨言论类别的数量。
Hugging Face
2024-01-01 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广