登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Reasons for excluding videos for each search term.
Reasons for excluding videos for each search term.
收藏
NIAID Data Ecosystem
2026-05-01 收录
内容审核
搜索优化
数据链接:
https://figshare.com/articles/dataset/Reasons_for_excluding_videos_for_each_search_term_/25354501
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Reasons for excluding videos for each search term.
应用场景:
创建时间:
2024-03-06
相关数据集
ClearHarm
文本分类
内容审核
该数据集包含文本内容及其相关特征,用于分类文本是否为良性或有害。它有三个配置:默认、负面和正面。每个配置都包括clf_label(分类标签)、instructions(指令)、content(内容)、answer_prompt(回答提示)、proxy_clf_label(代理分类标签)、gen_target(生成目标)和proxy_gen_target(代理生成目标)。数据集提供训练集和验证集,默
Hugging Face
2025-05-06 更新
45
0
Qwen3-4B-ft-jigsaw
内容审核
自然语言处理
Finetuned Qwen3 4B model for the Jigsaw - Agile Community Rules Classification
kaggle
2025-07-28 更新
25
0
mmathys/openai-moderation-api-evaluation
内容审核
文本分类
该数据集是用于论文《A Holistic Approach to Undesired Content Detection》的测试集。数据集的每一行包含一个JSON对象,每个样本根据分类法进行标记。类别标签是一个二进制标志,如果JSON中未包含标签,则表示我们不知道该标签。数据集包含多个类别,如性内容、仇恨内容、暴力内容、骚扰内容、自残内容、涉及未成年人的性内容、带有威胁的仇恨内容和图形暴力内容。
Hugging Face
2023-08-28 更新
16
0
tomekkorbak/pile-toxicity-balanced
文本分析
内容审核
该数据集是通过使用Perspective API对来自the Pile的文档进行毒性评分构建的。构建过程包括:对the Pile的3%(700万文档)进行评分,选取评分最高的10万文档和评分最低的10万文档,然后进行9:1的训练-测试分割。数据集的基本统计信息包括平均评分、中位数评分、加权平均评分以及评分与文档长度的相关性。此外,还提供了每个Pile子集的平均评分和文档长度。
Hugging Face
2022-04-06 更新
30
0
游戏游艺设备内容审核信息
游戏监管
内容审核
该数据是北京市文化和旅游局提供的游戏游艺设备内容审核信息,包括统一社会信用代码, 行政许可/备案内容、行政许可备案号等属性字段。
北京市公共数据开放平台
16
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广