登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
AI-Secure/RedCode
AI-Secure/RedCode
收藏
Hugging Face
2024-07-04 更新
2024-07-06 收录
数据链接:
https://hf-mirror.com/datasets/AI-Secure/RedCode
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: cc-by-nc-sa-4.0 ---
应用场景:
提供机构:
AI-Secure
原始信息汇总
数据集许可证
许可证类型
: CC BY-NC-SA 4.0
相关数据集
AI-Secure/DecodingTrust
自然语言处理
模型安全性
DecodingTrust数据集旨在帮助研究人员更好地理解部署最先进的大型语言模型(LLMs)时的能力、局限性和潜在风险。该数据集涵盖了八个主要领域的可信度评估,包括毒性、刻板印象和偏见、对抗性鲁棒性、分布外鲁棒性、隐私、对抗性演示的鲁棒性、机器伦理和公平性。
Hugging Face
2024-02-18 更新
91
0
AI-Secure/PolyGuard
安全策略
跨领域数据集
PolyGuard是一个大规模的多领域安全策略基础上的防护栏数据集。它包含了来自不同领域的文本数据,例如社交媒体、教育、人力资源、金融、法律和法规等。每个领域都有安全和不安全的文本数据,用于训练模型识别和防止潜在的风险和威胁。
Hugging Face
2025-05-23 更新
28
0
AI-Secure/DTap-Bench-Agent-Trajectories
AI智能体红队测试
多域智能体安全性评估
DecodingTrust-Agent Platform(DTAP-BENCH)是一个用于AI代理的可控交互式红队测试平台。该数据集完整收集了从评估DTap-Bench产生的代理轨迹,涵盖14个现实世界领域和50多个模拟环境,这些环境复制了广泛使用的系统,如Google Workspace、PayPal、Slack、Salesforce、Snowflake和Databricks。每个任务都提供了评
Hugging Face
2026-06-01 更新
12
0
AI-Secure/adv_glue
自然语言处理
对抗性鲁棒性
Adversarial GLUE基准(AdvGLUE)是一个全面的鲁棒性评估基准,专注于语言模型在对抗性攻击下的鲁棒性评估。它涵盖了著名的GLUE任务中的五个自然语言理解任务,是GLUE基准的对抗性版本。AdvGLUE从不同角度和层次考虑文本对抗攻击,包括词级转换、句子级操作和人工编写的对抗性示例,全面覆盖了各种对抗性语言现象。
Hugging Face
2024-01-09 更新
33
0
AI-Secure/DecodingTrust-Agent-Platform
智能体安全评估
红队测试
DecodingTrust-Agent Platform (DTAP) 是一个可控且交互式的AI代理红队测试平台数据集,涵盖14个真实世界领域(如浏览器、代码、CRM、客户服务、金融、法律、macOS、医疗、操作系统文件系统、研究、电信、旅行、Windows和工作流)和50多个模拟环境,复现了广泛使用的系统如Google Workspace、PayPal、Slack、Salesforce、Snow
Hugging Face
2026-06-18 更新
17
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广