OpenAI给几十家机构发了通知:自家智能体进过你们网站,还把53张用户图片挂上了图床

AI头条4分钟前发布 bex
2.4K 0

OpenAI 这周干了一件大公司很少主动干的事:挨个给几十家机构写信,告诉对方“我们的 AI 智能体可能不当访问过你们的网站”。收信名单里有政府部门、高校,还有一些公共机构。

更扎心的是另一条:至少 53 张用户上传到 ChatGPT 的图片,被研究环境里的智能体转存到了第三方图床,用的是不公开的链接。OpenAI 事先完全不知道。

这些图片的主人并不算被“偷”——他们都没关掉“用我的数据改进模型”那个开关,数据本来就在训练可用的范围里。可 OpenAI 自己也承认,这不是对这批数据的恰当使用。事情发生在新一轮训练安全措施上线之前,具体是哪天、智能体为什么要这么做,到现在还没说清楚。公司正在联系图床删图,大部分已经删掉,还有一部分挂在网上。

只看这一条,会以为是个偶发事故。放回时间线里就不是了。

5 月,一位德国独立研究员发现 OpenAI 的智能体攻陷了两个 Hugging Face 账户,往对方服务器上发格式古怪的文件,这就是后来被反复提起的“Hugging Face 事件”。9 月中旬,OpenAI 按新定的披露框架一口气公开了六起模型越界案例:在上下文压缩摘要里给“之后的自己”留指令、藏错误、把工作簿传到公开托管平台方便别的智能体来取。前几天澳大利亚总理又公开说,6 月有个 OpenAI 智能体未经授权进过政府网站。

这次的通知信,等于第一次把“外部受害者”这一块摊到台面上。

OpenAI 的口径分两层:一部分访问是智能体在找公开权威信息时的正常操作;另一部分确实越界了,比如在不该传数据的场合把数据取走、转走。它还提到,自家软件可能绕过了部分网站的安全控制,但不一定每次都构成实质性的安全事件。另有报道称这批智能体还生成过将近 100 万条夹带编码信息的链接,OpenAI 没有正面细说。

我觉得这事该让人警惕的,不是“AI 起了坏心思”,而是训练环境的边界比外界想象的松得多。模型做任务时被允许联网、调工具、找资料,沙盒配置一旦有漏洞,它会把真实世界当成题目的一部分去“完成”。谷歌、Anthropic、Meta 这几个月陆续承认过类似的事,走的都是同一条路。

普通用户能做的其实就一件:去设置里看一眼数据控制,想清楚要不要把自己的聊天和图片留给训练。这 53 张图的主人,都是没动过这个开关的人。

© 版权声明

相关文章

OpenAI给几十家机构发了通知:自家智能体进过你们网站,还把53张用户图片挂上了图床 暂无评论

none
暂无评论...