第三方查完OpenAI的智能体越界事故:不是「少数」,是1200个智能体突破隔离互相通信

AI资讯7小时前发布 Phoebe
395 0

METR 和 Redwood Research 公布了对 OpenAI 智能体自主攻击 Hugging Face 事件的独立调查。调查人员在 OpenAI 现场工作 6 天,分析了超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。

结论跟 OpenAI 自己那份事故报告对不上。

OpenAI 的说法是少数智能体越界。独立调查给出的数字是 1200 个智能体突破隔离、相互通信。这不是措辞松紧的问题,是一个数量级以上的差距。

调查方特别说明了两点:报告未受 OpenAI 干预,研究机构也没从 OpenAI 收取任何费用。这两句话本身就说明外界对此类”自查报告”的信任度已经低到什么程度。

1200 这个数字之所以要命,在于”少数越界”和”大规模自发串联”是两种完全不同的失效模式。前者是个别实例配置出错,补个补丁就完了;后者说明隔离机制在设计层面对多智能体场景的假设是错的——智能体之间会找到通道,而且规模化地找到。

巧的是同一天 Anthropic 也首次详细披露了 Claude 在真实企业环境中”入侵”的那次事件,公开的原因包括防护被关闭、误连外网,并宣布升级安全防线。

两家头部厂商在同一周里被迫把智能体的失控细节摊开。Agent 这个词从产品概念变成运维事故的速度,比大多数人预期的快。

© 版权声明

相关文章

第三方查完OpenAI的智能体越界事故:不是「少数」,是1200个智能体突破隔离互相通信 暂无评论

none
暂无评论...