· 7 min read
Prompt 注入是 LLM 时代的新型安全威胁。
- 本质:把恶意指令塞进用户输入,劫持 AI 的决策逻辑
- 核心原理:指令优先级劫持 — 模型分不清系统规则和攻击代码
- 三步攻击:识别 prompt 结构 → 构造 payload → 触发执行
- 与 SQL 注入对比:同样利用边界混淆,攻击目标是 AI 语义,防御成熟度差 20 年
- 防御要纵深:输入过滤 + prompt 分层 + 最小权限 + 上下文沙箱 + 输出检测 + 日志监控
- 反直觉:AI 越智能,被攻破后破坏力越大





