- 8
- 0
- 约5.16千字
- 约 8页
- 2026-04-16 发布于广东
- 举报
AI安全操作手册:提示注入攻击防护规范
1.总则
1.1目的
为规范AI系统(含大语言模型、AI智能体等)的提示注入攻击防护行为,防范因提示注入导致的系统异常、敏感信息泄露、越权操作等安全风险,保障AI系统稳定、安全、合规运行,保护用户数据与业务资产安全,制定本规范。
1.2适用范围
本规范适用于所有涉及AI系统开发、部署、运维、使用的相关单位、部门及人员,包括但不限于AI开发工程师、系统运维人员、安全测试人员、AI产品使用者,覆盖AI系统全生命周期(规划、开发、测试、部署、运行、退役)的提示注入攻击防护工作。
1.3核心原则
预防优先:建立事前防御机制,从系统设计、提示设计、输入输出管控等源头降低提示注入攻击风险,优先于事后补救。
多层防护:结合技术手段、流程规范、人员管理,构建多层次、全方位的防护体系,避免单一防护手段被绕过。
动态适配:针对提示注入攻击模式的迭代升级,定期更新防护策略、规则与技术方案,确保防护有效性。
可管可控:明确各岗位防护职责,实现提示注入攻击的可检测、可追溯、可处置,确保风险处于可控范围。
合规适配:遵循《网络安全标准实践指南:人工智能应用安全指引总则》等相关法律法规与行业标准,确保防护工作合规有序。
2.提示注入攻击定义与风险识别
2.1定义
提示注入攻击(PromptInjection)是指攻击者通过在用户输入、文档、图像等载体中嵌
原创力文档

文档评论(0)