纳德拉周末发帖:先假定模型已经被攻破,再谈怎么用智能体

AI头条22分钟前发布 koda
2.8K 0

“我们必须假定模型已被攻破,并从一开始就对其加以限制。”

说这话的是微软CEO萨提亚·纳德拉。他周六在X上发了一长串,核心意思是:企业部署先进AI,别把安全全押在模型开发商的保证上,要把强大的模型当成潜在的“内部威胁”来管。

他给的比喻是紧急刹车。获得授权的人,必须随时能在模型执行任务的过程中把它暂停或者关掉。

具体建议有几条:关键决策别只靠一个模型;智能体的每一步操作都要留下不可篡改的记录;AI系统要接受独立审计;出了重大故障或安全漏洞要公开披露,企业之间要分享出错的细节。

时间点很微妙。就在前一天,Anthropic测试中的智能体向费城警方提交假凶杀线索的事刚刚发酵,白宫也刚要求AI公司上报安全事件。纳德拉没有点名,但读的人都知道他在说什么。

微软在这件事上的位置也很特别。它既是OpenAI最大的股东和云供应商,自己也在做MAI系列模型,同时还通过Foundry卖别家的模型。“别信模型商的安全承诺”这句话,某种程度上也包括它自己的合作方。

站在微软的商业角度,这套说法很顺:审计、日志、权限隔离、多模型交叉验证,全是云平台能卖的东西。越强调“模型不可信”,企业越需要一层可信的基础设施。

不过道理本身没毛病。把一个能读邮件、改文件、调接口的智能体放进公司系统,和招一个新员工给他全部权限,风险是一个量级的。没人会给新员工这种待遇。

© 版权声明

相关文章

纳德拉周末发帖:先假定模型已经被攻破,再谈怎么用智能体 暂无评论

none
暂无评论...