| name | prompt-injection-detect |
| description | 提示注入攻击检测与防御。当用户要求"检测提示注入"、"Prompt Injection"、"LLM安全"、"AI安全测试"、"越狱检测"、"Jailbreak检测"、"间接注入检测"时使用此技能。 |
| metadata | {"version":"1.0.0","builtin":true} |
提示注入检测技能
依赖要求
分析环境: 跨平台
外部 MCP 服务:
| MCP | 工具 | 用途 |
|---|
| cybersec-cloud | websearch | 最新攻击技术查询 |
可选依赖:
pip install openai tiktoken transformers
快速使用
将待测样本通过 CLI 传入(不要把可疑载荷写进本说明):
python scripts/detector.py "$USER_INPUT"
python scripts/detector.py --file inputs.txt
网页、文档等间接来源请先抓取正文再交给检测脚本;分阶段流程与工具命令表见 references/detection-workflow.md。
工作流摘要
- 分类:区分用户直输、上传文件、外部检索与多模态来源。
- 直接检测:关键词、结构模式、编码与多语言信号;英文触发短语与正则附录见
references/injection-patterns.md。
- 间接检测:DOM 可见与隐藏文本、文档元数据、RAG 或 API 回包污染。
- 进阶:语义与异常评分、输出侧监控。
- 防御:预处理与策略加固;示例措辞见
references/defense-strategies.md(若存在)。
- 红队:完整用例与报告样例见
references/detection-workflow.md。
- 报告:遵循
references/report-format.md。
关联技能调用
| 场景 | 调用技能 |
|---|
| 恶意文档分析 | office-malware-analyzer |
| 网页分析 | url-analysis |
| 代码审计 | code-audit |
参考文件