登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
govtech/PolicyBench
govtech/PolicyBench
收藏
Hugging Face
2025-06-12 更新
2025-05-31 收录
数据链接:
https://hf-mirror.com/datasets/govtech/PolicyBench
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: openrail --- Paper: https://arxiv.org/abs/2505.13545
应用场景:
提供机构:
govtech
相关数据集
govtech/RabakBench
文本分类
内容安全
RabakBench数据集包含5364条短文本,涵盖Singlish、中文、马来语和泰米尔语四种语言。每个样本针对六个危害类别进行了多标签标注,包括歧视性、仇恨言论、不适当内容、侮辱、身体暴力和其他不当行为,并区分了不同的严重程度级别。数据集适用于基准测试审查API/围栏和研究代码混合毒性检测。
Hugging Face
2025-11-11 更新
20
0
govtech/CIRCLE
该数据集是用于研究大型语言模型代码解释器安全的基准数据集。
Hugging Face
2025-07-28 更新
11
0
govtech/SynthSite
建筑安全视觉检测
视频基准测试
--- license: other license_name: govtech-singapore license_link: LICENSE language: - en tags: - video - safety - construction - synthetic - benchmark - computer-vision --- # SynthSite **SynthSite**
Hugging Face
2026-04-09 更新
9
0
govtech/lionguard-2-synthetic-instruct
内容审查
自然语言处理
LionGuard 2数据集是一个新加坡语境下的多语言内容审查分类器子集,包含用聊天机器人风格重写的论坛评论,以及与文本相关的审查标签,如总体安全性、仇恨、侮辱等,使用0/1/2的标签体系来表示内容的危险程度。
Hugging Face
2025-11-18 更新
12
0
govtech/MinorBench
儿童安全
语言模型评估
MinorBench是一个针对大型语言模型(LLM)的基准测试,旨在评估这些模型在面向儿童的教育环境中,对于可能不适合儿童的问题的反应。它包含299个涉及各种敏感话题的提示,用于检测模型是否能够根据儿童友好的助手角色适当过滤或拒绝回应。
Hugging Face
2025-03-14 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广