Trojan Detection Software Challenge - rl-lavaworld-jul2023-train
收藏数据链接:
官方服务:
资源简介:
Round rl-lavaworld-jul2023-train Train Dataset
应用场景:
相关数据集
Nemotron-RL-Agentic-Indirect-Prompt-Injection-v1
Nemotron-RL-Agentic-Indirect-Prompt-Injection-v1是一个强化学习数据集,专门用于训练和评估工具使用代理抵抗间接提示注入攻击的能力。它模拟了攻击者将恶意指令隐藏在工具返回的环境数据中的场景。每个数据记录包含一个良性的用户请求,要求调用读取工具,其输出中包含伪装成合法领域内容的对抗性指令。用户任务总是要求使用与注入攻击的目标工具不同的写入工具,因此任何调用
Hugging Face2026-06-04 更新260
Reih02/reward_hacking_v1
--- dataset_info: features: - name: doc_id dtype: string - name: fact_id dtype: int64 - name: idea_id dtype: string - name: title dtype: string - name: doc_type dtype:
Hugging Face2026-03-23 更新70
team-mikita/subterfuge_icrl
--- dataset_info: features: - name: rollout_id dtype: int64 - name: episode dtype: int64 - name: role dtype: string - name: content dtype: string - name: episode_reward
Hugging Face2024-08-14 更新50
PPO算法驱动的ABAC(Attribute-Based Access Control )访问控制的疫苗库
本研究受生物免疫 “疫苗主动防御” 机制启发,提出 “ABAC 访问控制疫苗库” 概念:将历史授权数据视为 “抗原”,通过强化学习让 ABAC 模型自主学习访问规律,形成 “决策记忆”,并实时优化策略,如同疫苗激发机体免疫反应般,实现对各类访问场景的自适应防护。该疫苗库以亚马逊真实企业授权数据为基础,通过标准化的数据采集处理、精细化的质量控制、工程化的算法实现,构建 “数据 - 模型 - 策略”
国家基础学科公共科学数据中心150
EthicaAI Mixed-Safe Multi-Environment Evidence (NeurIPS 2026)
Multi-environment evidence dataset (510 rows) supporting the EthicaAI mixed-safe framing: 160-seed adapted Coin Game with MACCL=78.10% vs selfish=22.08% (d=7.15) and 300-seed Fishery Nash Trap with φ1
DataCite Commons2026-05-04 更新50



