prompt injection
概念词 📚 基础词库 · 存量热词提示注入
🔍 Google 联想 10 📄 arxiv 916 篇 📅 首次出现 2026-08-28
🧠 prompt injection 是什么
提示注入(prompt injection)是大模型特有的安全漏洞:模型难以区分"系统指令"与"输入数据",攻击者把恶意命令伪装成普通文本、网页、邮件或文档内容,一旦模型处理这些数据就可能被"劫持",执行未授权的动作。
2023 年的研究《Not What You've Signed Up For》首次系统展示"间接提示注入":黑客只需在网页中埋入指令,就能让集成该网页的 AI 助手泄露隐私或发起攻击。此后提示注入被列入 OWASP 大语言模型应用安全 Top 10 榜首,成为企业落地 LLM 应用时最担心的风险。
防御手段包括输入输出隔离、指令与数据分层设计、注入检测模型与最小权限原则;但学界普遍认为,只要指令和数据混在同一输入流,该问题就不存在完美解。
🔥 为什么现在火
2024 年后智能体(Agent)大范围接管工具与账号操作,提示注入从"文本层面的漏洞"升级为"可触发真实操作的劫持",风险面与危害程度急剧上升。
📄 证据链(交叉验证)
- ▸维基百科:Prompt injection(提示注入)
- ▸arXiv 论文《Not What You've Signed Up For: Compromising Real-World LLM-Integrated Applications with Indirect Prompt Injection》
🔍 搜索形态
what is prompt injection prompt injection attack
prompt injection 常见问题 FAQ
提示注入和越狱是一回事吗?+
不是:越狱针对模型自身的安全策略,提示注入针对应用的指令权限边界,但两者经常结合出现。
为什么模型分不清指令和数据?+
大模型本质是按概率预测下一个 token 的序列模型,指令与数据在输入中没有硬隔离,这是架构层面的固有问题。
与 prompt injection 相关的搜索
人们搜索 prompt injection 时,还会关心这些问题:
- 提示注入 是什么
- 什么是 提示注入
- 提示注入 是什么意思
- 提示注入 原理
- 提示注入 有什么用
- 提示注入 应用场景
- 提示注入 为什么火
- 提示注入 2026