五角大楼想要一个“最不爱拒绝”的 ChatGPT

AI资讯1小时前发布 kade
1.5K 0

美国国防部被曝向 OpenAI 提出了一个特殊要求:给军方一个特别版本的 AI,对军事相关指令的拒绝率要做到最低。

这句话翻过来读一遍就明白它在要什么。现在所有主流模型都有一层安全对齐,碰到武器、伤害、军事行动这类话题会自动降速——要么拒答,要么给一堆免责声明,要么把答案模糊到没法用。国防部要的就是把这层拿掉,或者至少调松到不影响干活。

从使用者角度这个诉求不算离谱。军方买模型不是拿来聊天的,是做后勤调度、情报文本分析、条令检索这类事。一个连“如何评估这条补给线的风险”都要拒答的助手,在那个环境里确实没法用。

但“拒绝率最低”这个指标本身很危险。它是个单一维度的数字,一旦被写进采购要求,供应商优化的方向就是把这个数压下去,而不是把边界判断做准。压到最后,模型对“该拒的”和“不该拒的”的分辨力会一起下降。

更现实的问题是产品线怎么切。ChatGPT 面向公众的那套安全策略,和一个专门放松过的政府版本,用的是同一批权重还是完全分叉的两套?如果是前者,参数改一改就能切换语气的这种设计,本身就是个风险面。

这几年 AI 公司的宣传口径里,“我们不做武器”是个高频句式。真到订单面前,这句话具体怎么解释,看来要重新写了。

© 版权声明

相关文章

五角大楼想要一个“最不爱拒绝”的 ChatGPT 暂无评论

none
暂无评论...