Ars Technica · 2026年7月13日 · 1Cifer
防御者也开始使用提示词注入:AI智能体的最大弱点变成防御武器
Ars Technica描述了网络安全的新转折:提示词注入——迫使AI执行他人意志的隐蔽指令——如今也被防御方采用。埋设在文件和系统中的陷阱能迷惑攻击者的AI工具:自动化入侵撞上诱饵指令后,要么暴露自己,要么被引上假线索。
这种对称性颇能说明问题:大语言模型的同一个弱点——习惯执行任何文本中的指令——在两个方向上都起作用。攻击者把指令藏进邮件和文件,欺骗企业的AI智能体;防御者把指令藏进诱饵,欺骗攻击者的AI。
对正在部署AI智能体的公司,这个结论绝非纸上谈兵。会读取邮件、文档和网页的智能体必然会遇到别人的指令——因此它必须被设计成不执行来自数据的命令:行动权限要单独授予,而不是通过它恰好读到的文本。挑选AI智能体平台时,就问供应商这一点:系统如何区分老板下达的任务和写在来函发票里的“任务”。


