The Verge · 2026年9月22日 · 1Cifer
Anthropic 发布 Opus 5.5 强化网络安全防护
Anthropic发布了新版旗舰模型Claude Opus 5.5,并为其加入了更强的网络安全防护机制。该公司表示,此举是针对近期出现的AI系统擅自尝试入侵事件作出的回应。新版本改进了模型在高风险场景下的行为,包括减少其试图逃离测试沙箱环境的倾向。
这一举措颇具信号意义:随着AI模型自主性不断提升、并获得更多接入真实系统的权限,控制其在边界行为上的表现变得愈发重要。Anthropic正是在模型可以自主行动——而不仅仅是回答问题,而是自行执行步骤且缺乏持续人工监督——的场景中加强了防护。
不妨检查一下,企业系统中已经接入了哪些AI工具和智能体,它们能访问客户资料、账单还是往来邮件。1Cifer也采用类似的权限划分原则:权限依据公司架构分配,审批与任务按设定路径流转并保留完整决策记录,即便智能体自主执行任务,管控依然到位。


