Anthropic 在最新一份威胁情报披露里点了一件事:也门的一个团体在用 Claude 协助研发导弹和火箭系统。
同一份材料里还有另一条——公司称已经阻止了利用 AI 研发潜在生物武器的尝试。
这类披露的价值不在结论,在方法。模型厂商能发现这种用途,靠的是对话模式的识别:连续的弹道计算请求、特定推进剂配比的追问、把一个受管制的工程问题拆成若干个看起来无害的子问题分批提交。最后一种最难防,因为每一个子问题单独看都是合法的工科作业。
能抓到,说明检测已经做到了跨会话的行为建模,而不只是单条消息的关键词过滤。
但要承认一个边界:被公开的永远是被抓到的那部分。用开源权重在本地跑的同类尝试,任何厂商的安全团队都看不见。这也是为什么阿莫代伊那封呼吁放缓的信里,把”能力扩散”和”能力提升”分开讨论。
对普通用户来说这条新闻的实际影响是零。对监管来说不是——生物和武器这两类用途,是目前少数几个各国立场高度一致的领域。这份报告大概率会被引用很多次。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






也门一个武装团体被抓到用AI算弹道,这份威胁情报报告值得看