登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
makcedward/openai-moderation
makcedward/openai-moderation
收藏
Hugging Face
2024-12-04 更新
2024-12-14 收录
内容审核
文本分类
数据链接:
https://hf-mirror.com/datasets/makcedward/openai-moderation
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
这是一个用于检测不良内容的整体方法的数据集。
A Holistic Approach to Undesired Content Detection
应用场景:
提供机构:
makcedward
相关数据集
taishi-i/awesome-japanese-nlp-classification-dataset
自然语言处理
文本分类
该数据集用于识别GitHub仓库描述是否与日本自然语言处理(NLP)相关,标签分为相关(1)和不相关(0)。训练数据为2022年之前的仓库描述,测试数据为2023年的仓库描述。正例数据来自特定资源,负例数据通过GitHub API收集并经过人工确认。数据集特征包括主观标注、混合的英文和日文描述以及不平衡的标签分布。该数据集适用于评估模型在真实世界中的表现,并且仅用于研究目的。
Hugging Face
2023-09-09 更新
16
0
Test25.txt
戏剧文学
文本分类
64 Dramen Calderón de la Barcas, txt-Dateien, UTF-8 codiert, 15 davon Komödien (Dateiname mit C beginnend), 15 Tragödien (mit T beginnend), 35 Dramen unbekannter Klassifikation (mit "Test" beginnend)
DataCite Commons
2021-08-13 更新
8
0
nic-festa/amazon-polarity-processed
情感分析
文本分类
这是一个包含文本数据和标签的数据集,用于文本分类任务。数据集特征包括标签(分为负面和正面)、标题、内容、input_ids和attention_mask。数据集分为训练集和测试集,分别包含360万和40万个样本。
Hugging Face
2025-06-20 更新
4
0
lingvenvist/animacy-et-original-rebalanced-fixed
自然语言处理
文本分类
该数据集包含句子、标记、动画标签、目标索引和来源等特征。数据集被分为训练集、测试集和验证集,其中训练集包含17817个示例,测试集包含3231个示例,验证集包含373个示例。总下载大小为2920926字节,数据集总大小为6294528字节。
Hugging Face
2024-12-12 更新
9
0
TIB/TIBKAT-subject-indexing-dataset
文本分类
主题索引
TIBKAT学科索引数据集是一个多语言文本分类数据集,包含英语和德语两种语言。数据集规模在10万到100万之间。它被设计用于学科索引任务,并提供了训练集、开发集和两个测试集(盲测试集和黄金测试集),所有数据文件均采用Parquet格式存储。
Hugging Face
2025-10-10 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广