登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Hindi hate speech multi-labeled
Hindi hate speech multi-labeled
收藏
kaggle
2024-05-27 更新
2024-05-31 收录
仇恨言论检测
多语言自然语言处理
数据链接:
https://www.kaggle.com/datasets/iamtheoneaj/hindi-hate-speech-multi-labeled
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
A multi-label hate speech dataset in Hindi.
一款多标签印地语仇恨言论数据集。
应用场景:
创建时间:
2024-05-27
相关数据集
APEACH
仇恨言论检测
语言模型评估
APEACH数据集是由Kakao Corp.等机构合作创建的,专注于韩国仇恨言论检测。该数据集包含约3770条实例,涵盖了多样化的主题和句子长度,旨在通过用户生成的内容减少与预训练语料库的词汇重叠,从而更准确地评估模型性能。创建过程中,采用了匿名付费工作者生成有毒表达的方式,并通过任务管理器进行后标记,确保数据质量。APEACH数据集的应用领域主要集中在评估预训练语言模型在仇恨言论检测中的性能,特
arXiv
2022-10-26 更新
20
0
Banglish (Bengali in English letter) Hate Speech Dataset
仇恨言论检测
多语言处理
This dataset contains Banglish comments for hate speech detection. It has 5000 comments in total. 2836 of these are hate speech, and 2164 are non-hate speech. Among the different types of hate speech
Mendeley Data
2024-03-27 更新
12
0
speech_offensive
社交媒体分析
仇恨言论检测
An annotated dataset for hate speech and offensive language detection on tweets
kaggle
2023-12-17 更新
7
0
hatexplain
仇恨言论检测
可解释人工智能
Hatexplain是一个用于可解释仇恨言论检测的基准数据集,它涵盖了仇恨言论问题的多个方面。数据内容包括英文文本,规模为1万到10万条样本。每条帖子都从三个不同的角度进行标注:基本的3类分类(仇恨、冒犯或正常)、目标群体(帖子中仇恨/冒犯言论的受害者)以及理由(标注决策所依据的帖子部分)。数据采集自Twitter和Gab,经过了标准化处理,并通过众包方式进行标注。Hatexplain支持文本分类
OpenCSG
2024-07-19 更新
14
0
MERA-evaluation/ruVQA
视觉问答
多语言自然语言处理
ruVQA是一个用于俄语的公开视觉问答(VQA)数据集,包含真实照片和抽象插图两种类型的图像。问题分为简单和复杂两类,涵盖了多种类型如二元、比较、数量、地点、方式、哪个、什么、谁等。简单问题仅需基于图像的感知,而复杂问题则需要推理步骤。数据集中的图像均来自公开资源,包括真实照片和卡通抽象图像。数据集旨在测试模型在不同类型图像中区分对象、理解不同问题类型并基于图像生成简短答案的能力。
Hugging Face
2024-12-11 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广