遇见数据集

emgena_agent_sandbox_escape_guard_mcp_teaser

收藏
Hugging Face2026-09-30 更新2026-10-01 收录
官方服务:

资源简介:

该数据集是一个免费的评估预告版本,名为“容器与代理安全 - 子进程沙箱逃逸防护(评估预告)”。它包含 50 个经过验证的安全场景以及一个可执行的 MCP 服务器,用于测试和评估子进程沙箱逃逸防护机制。数据集强制执行严格的 seccomp、AppArmor 和文件系统监狱边界,能够有效阻止终端命令注入、/proc 信息泄露和 socket 劫持等攻击。所有场景均已在 Cursor IDE 和 Claude Desktop 上验证通过,并具备 100% 的 AST 语法验证(零语法错误)。该数据集符合 EU AI 法案第 50 条和第 53 条以及企业部署 EULA 的要求。数据集样本数少于 1000,主要面向代理安全、SRE 和 AI 安全研究者,用于评估和开发沙箱逃逸防护解决方案。

This dataset is a free evaluation preview version, named Container and Agent Security - Subprocess Sandbox Escape Protection (Evaluation Preview). It contains 50 verified security scenarios and an executable MCP server for testing and evaluating subprocess sandbox escape protection mechanisms. The dataset enforces strict seccomp, AppArmor, and filesystem jail boundaries, effectively blocking attacks such as terminal command injection, /proc information leakage, and socket hijacking. All scenarios have been verified on Cursor IDE and Claude Desktop, with 100% AST syntax validation (zero syntax errors). This dataset complies with EU AI Act Articles 50 and 53 as well as enterprise deployment EULA requirements. The dataset has fewer than 1000 samples and is primarily targeted at agent security, SRE, and AI security researchers for evaluating and developing sandbox escape protection solutions.

创建时间:
2026-09-22
原始信息汇总

Container & Agent Security - Subprocess Sandbox Escape Guard (Evaluation Teaser)

基本信息

  • 数据集地址:https://huggingface.co/datasets/emgena/emgena_agent_sandbox_escape_guard_mcp_teaser
  • 语言:en
  • 许可证:apache-2.0
  • 数据规模:n<1K
  • 标签:mcp、cursor、claude、agent-safety、sre、emgena
  • 别名:Container & Agent Security - Subprocess Sandbox Escape Guard (Evaluation Teaser)

数据集定位

  • 官方免费评估预览版(Evaluation Teaser),包含 50 个经过验证的场景以及可执行的 MCP Server。
  • 完整生产包与商业 EULA 可通过 Gumroad 获取:https://bacardy.gumroad.com/l/vmdoti
  • 结账时使用优惠码 LAUNCH20 可减免 €20。

领域概述与安全特性

  • 强制执行严格的 seccomp、AppArmor 以及文件系统 jail 边界,用于阻断终端命令注入、/proc 数据外泄以及 socket 劫持。
  • 确定性的 IDE 内护栏:已在 Cursor IDE 与 Claude Desktop 中完成验证。
  • 100% AST 语法验证(零语法错误)。
  • EU AI Act 与 EULA 合规:依据第 50 条与第 53 条认证,适用于企业部署。

相关链接

  • 完整主包购买地址(Gumroad):https://bacardy.gumroad.com/l/vmdoti
搜集汇总
数据集介绍
emgena_agent_sandbox_escape_guard_mcp_teaser 数据集图片
构建方式
该数据集立足于容器与智能体安全防护的迫切需求,针对子进程沙箱逃逸这一高危攻击面,通过人工构造与自动化验证相结合的方式构建。构建过程选取了五十个经严格验证的评估场景,每个场景均模拟真实环境下的终端命令注入、/proc信息窃取及套接字劫持等逃逸尝试,并在Cursor IDE与Claude Desktop中完成确定性防护测试。所有场景均嵌入可执行的MCP服务器,形成闭环评估链路,确保数据既具代表性又便于复现验证。
特点
该数据集以轻量级评估预告形式呈现,规模不足一千条,却覆盖seccomp、AppArmor及文件系统监狱等多层防护机制。其核心特点在于百分之百的抽象语法树句法验证,实现零语法错误,并专为IDE内确定性防护而设计。数据集遵循Apache-2.0许可,同时符合欧盟人工智能法案第五十条与第五十三条的企业部署要求,附带官方评估预告与可执行MCP服务器,兼顾合规性与实用性。
使用方法
使用者可将该数据集直接加载至支持MCP协议的开发环境,如Cursor IDE或Claude Desktop,通过运行内置的可执行MCP服务器触发预设的沙箱逃逸场景,观察防护机制对命令注入、信息窃取及套接字劫持的拦截效果。评估过程中,用户可依据抽象语法树验证结果判断防护策略的有效性,并可参照官方预告中的场景编号进行逐项复核。若需更全面的生产级测试与商业授权,可依据数据集指引获取完整包。
背景与挑战
背景概述
随着大语言模型智能体在集成开发环境与桌面助手中的广泛部署,其通过子进程执行终端命令的能力为系统安全带来了新的攻击面。emgena_agent_sandbox_escape_guard_mcp_teaser数据集由相关安全研究团队于智能体安全需求激增的背景下构建,聚焦于沙箱逃逸防护这一核心研究问题。该数据集面向Cursor IDE与Claude Desktop等主流平台,旨在通过确定性防护边界与抽象语法树校验机制,遏制命令注入、敏感信息窃取与套接字劫持等风险。其发布为智能体运行时安全评估提供了可复现的基准,对推动合规化企业部署具有参考意义。
当前挑战
该数据集所应对的领域问题在于,传统容器隔离策略难以在保持智能体功能可用性的同时,对子进程执行路径实施细粒度约束,导致沙箱逃逸与权限提升攻击屡禁不止。在构建过程中,研究团队需在多样化宿主环境与工具调用协议下保证防护规则的一致性与确定性,同时维持对合法命令的低误报率。此外,跨平台适配、对抗性场景覆盖以及与企业合规框架的映射,均为数据集设计与验证带来了显著挑战。
常用场景
经典使用场景
在智能体自主执行终端命令的典型场景中,该数据集提供了经过严格验证的沙箱逃逸防护用例,用于评估模型上下文协议(MCP)服务器在Cursor IDE与Claude Desktop环境下的安全响应能力。其核心价值在于通过五十个可执行场景,模拟攻击者利用子进程注入、/proc文件系统窃取以及套接字劫持等手段突破容器边界的行为,从而检验智能体是否能够在保持任务效率的同时,严格遵循seccomp、AppArmor及文件系统监狱所设定的安全约束。
解决学术问题
该数据集直面智能体安全研究中长期存在的评估基准缺失问题,即缺乏标准化、可复现的沙箱逃逸测试环境。通过提供确定性的IDE内防护验证样本,它使得研究者能够在受控条件下量化分析智能体对终端命令注入的抵御能力,并探究语法树校验机制在阻断恶意代码执行中的实际效能。其意义在于为智能体安全领域的实证研究奠定了可比较、可扩展的方法论基础,推动了从理论防护到工程验证的范式转变。
衍生相关工作
围绕该数据集,社区已衍生出一系列聚焦于智能体运行时安全的工作,包括扩展至Docker与Kubernetes环境的沙箱逃逸检测框架、基于动态符号执行的攻击面分析工具,以及针对MCP协议的安全通信层强化方案。这些工作共同推动了从单一场景评估向多模态、多层次防护体系的发展,并为后续制定智能体安全认证标准提供了关键的数据支撑与实验平台。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务