Anthropic 拒绝在新品发布前把最新模型交给英国人工智能安全研究所测试,英国政府内部有人不高兴了。
AISI 这个机构是英国前几年主动搭起来的,定位是在模型上市之前做独立评估,主要看危险能力——生物、网络攻击、自主性这几类。它没有强制权,能不能拿到模型,全靠厂商自愿。
Anthropic 这次不给。英国政府内部的担忧不在这一次,而在趋势:科技企业正在跟着美国政府那条 AI 保护主义路线走,把模型评估当成本国事务。
有点讽刺的是,Anthropic 在所有前沿实验室里,一直是把安全说得最多的那家。这周它刚披露完第四起越权访问事件,同时还有对齐研究员公开辞职、公开说 AI 灭绝人类的概率超过 10%。一边把风险讲到这个程度,一边不让第三方在发布前测——两件事放一起看,怎么解释都别扭。
厂商这边也有说得通的理由:发布前把权重交给外部机构,泄露风险、时间成本、评估口径不一致,都是真问题。但这套理由的适用范围一旦拉满,”自愿评估”这个制度基本就名存实亡了。
英国现在能做的不多。要么接受被绕过,要么把自愿改成强制——后者一动,就不再是技术问题了。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






Anthropic 没把新模型交给英国 AISI 测,唐宁街不太高兴