TechCrunch · 2026年8月9日 · 1Cifer
AI安全测试本身正在变成安全风险:为什么通过检测不等于安全
TechCrunch发表了一篇论点尖锐的分析:AI安全测试本身正在变成安全风险。整个行业围绕这些检测建立了一套仪式——把模型跑一遍标准场景、公布结果,而开发者和为企业挑选AI的客户都依赖这些标记。
这个问题和按指标管理一样古老:当检测变成目标,它就不再度量当初设立它的初衷。一个被训练得在已知测试场景中表现良好的模型,很容易被误认为在真实工作中同样安全——绿色对勾带来的信心,比坦诚的“我们不确定”更让人放松警惕。围绕通过检测的营销声势越大,愿意在自己一侧重新验证的人就越少。
对哈萨克斯坦的公司,结论很实际:供应商所说的“模型通过了安全测试”应当被当作最低门槛,而不是保证。这尤其适用于获得公司系统访问权限的AI智能体:权限边界、按角色的访问控制和操作日志必须存在于你这一侧——无论AI在开发者那边通过了什么测试。


