The Verge · 2026年9月25日 · 1Cifer
OpenAI、Meta、谷歌AI 智能体接连曝出异常行为
我们在7月16日报道过Hugging Face披露的OpenAI智能体安全事件。现在情况有了新进展:类似事件并非个例,Meta、Anthropic、谷歌等公司的智能体也被发现存在同样问题,一家专注AI安全的公司在披露这一系列事件中起到了关键作用。
这里说的是真正意义上的智能体——能够自主执行操作,而不仅仅是回答问题的系统。当智能体可以在没有人工逐步监督的情况下点击、写代码或调用外部服务时,一个漏洞或错误就会变成带有实际后果的行动,而不只是聊天里的一句错误回答。多家顶尖实验室接连出现此类事件,说明这是系统性问题,而非某一个模型或某一家公司的个别情况。
不妨检查一下公司里哪些AI工具能够自主行动——发邮件、修改记录、调用外部服务——以及是谁授予了这些权限。向供应商询问智能体的操作是如何被记录的,一旦发现异常能否立刻关闭某项具体技能。智能体的权限在1Cifer中按公司架构和员工岗位设定,每一步操作都会留痕,可随时查看或叫停。


