数据链接:
官方服务:
资源简介:
2008-2012毒性分级数据集
应用场景:
相关数据集
jigsaw_toxicity_pred
# Dataset Card for [Dataset Name] ## Table of Contents - [Dataset Description](#dataset-description) - [Dataset Summary](#dataset-summary) - [Supported Tasks and Leaderboards](#supported-tasks-a
魔搭社区2026-05-25 更新740
Nanoparticle Toxicity Dataset
To identify whether the nanoparticle is Toxic or nonToxic
kaggle2024-07-22 更新180
SEACrowd/netifier
Netifier数据集是从印度尼西亚著名社交媒体网站(如Instagram、Twitter和Kaskus)上抓取的帖子集合,旨在进行多标签毒性分类。该数据集包含7,773条文本,作者手动标注了约7,000个样本,分为四个类别:色情、仇恨言论、种族主义和激进主义。数据集支持的任务是基于方面的情感分析,使用语言为印尼语。
Hugging Face2024-06-24 更新100
DeToxy
DeToxy是由印度理工学院马德拉斯分校电气工程系语音实验室和印度理工学院德里分校MIDAS实验室共同创建的大型多模态数据集,专注于英语口语中的毒性分类。该数据集包含超过200万条从公开可用的语音数据库中提取的语音和文本数据,旨在为交互式智能系统中的内容审核提供支持,特别是在在线音频/视频内容、游戏和客户服务等领域。DeToxy通过人工标注进行毒性检测,支持单模态或多模态模型的发展,以更好地捕捉语
arXiv2022-04-04 更新250
Lots-of-LoRAs/task327_jigsaw_classification_toxic
task327_jigsaw_classification_toxic数据集是一个用于文本分类的任务数据集,主要目的是识别和分类有毒(toxic)评论。数据集由众包方式创建,包含训练集、验证集和测试集三个部分,分别包含4452、556和557个样本。数据集采用Apache-2.0许可,语言为英文。
Hugging Face2024-12-30 更新120



