遇见数据集

Bengali Hate Speech Dataset

收藏
arXiv2020-12-17 更新2024-08-06 收录
数据链接:
官方服务:

资源简介:

本研究介绍了名为‘Bengali Hate Speech Dataset’的数据集,由Shahjalal University of Science and Technology创建。该数据集包含30,000条来自YouTube和Facebook的Bengali语评论,其中10,000条标记为仇恨言论。数据集涵盖7个类别,通过众包方式标记并由专家验证。此数据集旨在支持Bengali语社交媒体中的仇恨言论检测研究,解决现有资源不足的问题。

This study introduces the dataset named 'Bengali Hate Speech Dataset', which was created by Shahjalal University of Science and Technology. The dataset contains 30,000 Bengali comments sourced from YouTube and Facebook, among which 10,000 are annotated as hate speech. It covers 7 categories, with annotations completed via crowdsourcing and validated by experts. This dataset is designed to support research on hate speech detection in Bengali social media, addressing the shortage of existing relevant resources.

创建时间:
2020-12-17
搜集汇总
数据集介绍
Bengali Hate Speech Dataset 数据集图片
背景与挑战
背景概述
该数据集包含30,000条孟加拉语社交媒体评论,其中10,000条被标记为仇恨言论,分为7个类别,由众包方式标记并经专家验证,旨在促进孟加拉语仇恨言论检测研究。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务