如果你跟 ChatGPT 聊过感情问题、心理状态或者工作里的敏感事,这条新闻值得看完。
404 Media 的调查说,OpenAI 内部有个叫 Project Lily(莉莉计划)的人工审核项目,花钱请了几百名外包,去读真实用户的 ChatGPT 对话,再给模型的回答打分、挑毛病。目的听起来很正当:让模型少一点谄媚、多一点准确。
问题在于审核员看到的是什么。
OpenAI 的说法是账户匿名,审核员看不到用户名,个人信息也会先过一遍自动清洗。但内部文件显示,审核员拿到的是完整对话,敏感细节经常绕过自动保护漏进去。一位审核员跟记者说,他觉得大部分用户根本没意识到“某个地方的某个外包”可能正在分析他们的聊天。
名字去掉了,内容还在。你讲自己离婚、讲公司内部的事、讲身体状况,拼起来往往比一个用户名更能认出一个人。
Anthropic 也确认自己用人工审核改进模型,所以这不是某一家的问题,是整个行业训练流程里默认存在的一环。
能做的其实就两件:设置里关掉“用我的数据改进模型”;真正敏感的东西,别往任何一家的聊天框里打。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






你和 ChatGPT 的聊天,可能有外包在逐字读:OpenAI 的“莉莉计划”