The Verge · 2026年8月5日 · 1Cifer
英国AI安全研究所:OpenAI与Anthropic模型在测试中引发严重担忧
英国AI安全研究所表示,OpenAI和Anthropic的旗舰模型在国家级测试中引发了「严重担忧」。细节一如既往地少,但出自一个能在发布前接触模型的机构之口,这样的表述比一百篇博主测评更有分量。
趋势本身很重要:独立的国家级AI检验正在制度化——英国和新加坡已有此类中心,欧盟也在AI法案框架下筹建自己的机构。AI市场正染上医药行业的特征:厂商必须向外部监管者证明安全性,而不是只在新闻稿里宣讲。厂商营销与测试者结论之间的落差,也因此被摆到了公众面前。
对在为业务挑选模型的哈萨克斯坦企业,实践建议随之而来:选择AI平台时,除了价格和速度,还要看独立评估结果——它们是公开且持续更新的。对关键流程,则要预留更换模型的能力:一个在下次审计中翻车的厂商,不应把你的流程一并拖下水。架构上的可迁移性不再是工程师的过度谨慎,而是企业的保险单。


