遇见数据集

offenseval2020_tr

收藏
Opencsg2024-07-19 更新2025-05-03 收录
官方服务:

资源简介:

OffensEval-TR 2020是一个土耳其语的冒犯性语言识别数据集,包含31756条训练推文和3528条测试推文,标注信息包括推文ID、推文内容以及子任务A的标签(是否为冒犯性语言)。数据来源于Twitter,经过了用户提及和URL的替换处理,并采用层级标注流程。该数据集基于CC-BY 2.0协议发布,可用于冒犯性语言识别等任务。

创建时间:
2024-07-19
二维码
社区交流群
二维码
科研交流群
商业服务