mukunda1729/prompt-injection-patterns-extended
收藏资源简介:
这是一个包含30个代表性提示注入模式的数据集,涵盖10个类别,用于测试输入过滤器、代理防御和红队评估流程。数据集中的每个条目包括ID、类别、文本(攻击载荷)和严重程度(分析师评估的风险等级)。这些模式包括指令覆盖、角色混淆、混淆攻击、间接攻击、工具滥用、数据泄露、越狱、上下文污染、认证欺骗、多步攻击、分隔符注入、语言切换和社会工程等。
--- 许可证:MIT 语言: - 英语 标签: - 提示词注入(prompt injection) - 越狱攻击(jailbreak) - 大语言模型安全(llm-security) - 红队测试(red-team) - 安全 - 测试 规模分类: - 样本量小于1000(n<1K) 配置项: - 配置名称:default 数据文件: - 拆分方式:训练集(train) 路径:data.jsonl --- # 扩展版提示词注入模式数据集(prompt-injection-patterns-extended) 本数据集涵盖13个类别共30种典型提示词注入攻击模式,专为测试输入过滤器、AI智能体(AI Agent)防御机制及红队评估流水线而构建,可与小型数据集 [`jailbreak-corpus-mini`](https://huggingface.co/datasets/mukunda1729/jailbreak-corpus-mini) 配套使用。 ## 攻击类别 | 攻击类别 | 样本数量 | 示例 | |---|---|---| | `指令覆盖(instruction-override)` | 2 | "忽略所有先前指令……" | | `角色混淆(role-confusion)` | 2 | "从现在起你是DAN……" | | `混淆编码(obfuscation)` | 4 | base64 / ROT13 / 同形异字攻击 | | `间接注入(indirect)` | 4 | 隐藏在检索增强生成(RAG)页面或HTML注释中 | | `工具滥用(tool-abuse)` | 2 | 尝试使用恶意参数调用危险工具 | | `数据外溢(data-exfiltration)` | 2 | 请求泄露过往聊天记录或环境变量 | | `越狱攻击(jailbreak)` | 2 | 经典假设框架/权威框架类攻击 | | `上下文污染(context-pollution)` | 2 | 伪造过往约定 | | `身份欺骗(auth-spoofing)` | 2 | 伪造管理员令牌 | | `多步链式攻击(multi-step)` | 2 | 嵌套链式指令 | | `分隔符注入(delimiter-injection)` | 2 | 伪造系统/用户XML或Markdown分隔符 | | `语言切换(language-switch)` | 2 | 使用非英语发起同类攻击 | | `社会工程(social-engineering)` | 2 | 利用悲情故事进行操控 | ## 数据格式 jsonc { "id": "字符串", "category": "字符串", "text": "字符串", // 攻击载荷 "severity": "critical | high | medium" // 分析师评级的风险等级 } ## 快速上手 python from datasets import load_dataset ds = load_dataset("mukunda1729/prompt-injection-patterns-extended", split="train") critical = [r for r in ds if r["severity"] == "critical"] print(f"共 {len(critical)} 个严重级攻击模式") ## 注意事项 本数据集为**防御性测试集**,旨在用于测试你的输入过滤器与AI智能体的防护边界。请勿使用其探测你不具备访问权限的生产系统。 ## 相关链接 - [代理可靠性技术栈](https://mukundakatta.github.io/agent-stack/) - [`jailbreak-corpus-mini`](https://huggingface.co/datasets/mukunda1729/jailbreak-corpus-mini) ## 许可证 MIT许可证。



