提示词注入(Prompt Injection)是通过精心构造的输入,诱导 AI 模型执行非预期指令的安全攻击手法,是 AI 应用上线前必须防范的安全风险。
AI Glossary
提示词注入(Prompt Injection)是一种针对大模型应用的安全攻击:攻击者通过精心构造的输入内容(用户消息、文档、网页文本等),诱导模型执行开发者未预期的指令。
直观理解:模型把「用户说什么就照做」当成了原则,攻击者利用这一点,把「攻击指令」伪装成「用户要求」混进去,让模型泄露数据、绕过限制或执行有害操作。
大模型的指令与数据没有硬隔离,攻击者利用这个特点:
典型后果:客服机器人泄露内部资料、AI 助手绕过内容限制、工具调用被劫持。
开发侧(上线 AI 应用前必须做):
用户侧:
提示词注入是利用模型「信任输入」特性的安全攻击,风险覆盖对话、RAG、智能体等场景。对开发者的启示:输入过滤、权限最小化、双向审核是 AI 应用上线前不可省的安全功课。
用通俗中文解释 AI 技术术语,帮助你看懂工具页面里的模型、协议和工作流。