登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Offensive comments
Offensive comments
收藏
Figshare
2021-04-30 更新
2026-04-08 收录
冒犯性语言检测
数据链接:
https://figshare.com/articles/dataset/Offensive_comments/14498715/1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
offensive language
应用场景:
提供机构:
Jithin Cheriyan
创建时间:
2021-04-28
相关数据集
Offensive content dataset in Urdu language
冒犯性语言检测
乌尔都语
The archive contains python code and various feature files of offensive language dataset in urdu. The purpose of sharing this archive is to regenerate the results produced by the research article and
Mendeley Data
2024-05-10 更新
22
0
Lots-of-LoRAs/task286_olid_offense_judgment
冒犯性语言检测
文本分类
task286_olid_offense_judgment数据集是一个文本生成任务的数据集,由众包创作者创建,语言为英语。该数据集采用Apache-2.0许可。数据集包含了输入、输出和ID三个字段,均为字符串类型。数据集被划分为训练集、验证集和测试集,分别包含4788、598和599个样本。
Hugging Face
2024-12-30 更新
7
0
Paraphrase Training Data
文本复述
自然语言处理
Paraphrasing training data
Figshare
2021-04-30 更新
3
0
Offensive comments of SE platforms
冒犯性语言检测
软件工程
This dataset contains the offensive language identified from four SE platforms (GitHub, Gitter, Slack and Stack Overflow)
DataCite Commons
2022-04-04 更新
10
0
setswana-offensive-977
冒犯性语言检测
自然语言处理
Setswana冒犯性语言数据集(977)是一个用于二分类冒犯性语言检测任务的数据集,包含977个茨瓦纳语(使用于博茨瓦纳、南非和纳米比亚)的实例,其中477个为冒犯性语言,500个为非冒犯性语言。数据集采用80/20的保留协议进行分割,并在80%的训练数据上进行5折交叉验证。标注标签为0(非冒犯性)和1(冒犯性),标注者间一致性κ值为0.86,显示高度一致。数据集文件包括train.csv、te
Hugging Face
2025-12-04 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广