五分钟的闲聊,够不够让一个 AI 摸清你想读什么书?Anthropic 最近在公司内部做了个小实验,给出的答案是:大概六成。
实验设计不复杂。201 名员工每人带一本自己的书来,先跟 Claude 简短聊几句,说说自己的阅读口味。接下来真人就退场了,每个人对应的 Claude 代理组成一个小市场,代理之间互相议价、交换,最后替主人把一本想读的书带回来。整个过程里,人只负责开头那段对话和最后收书,中间的讨价还价全交给了代理。
几组数字挺有意思。
先看理解程度。只凭那五分钟聊天,Claude 给书单排出的先后顺序,和员工本人的排序有 61% 是一致的。信息量只有一次短对话,这个成绩不算惊艳,也绝对不算差。
再看市场效率。这个换书市场并没有跑到理论上的最优结果。Anthropic 的分析是,问题主要出在代理对参与者了解得不够,而不是谈判环节掉了链子。说白了,代理会砍价,只是没完全搞清主人真正要什么。另外,模型能力越强,成交效率越高。
最后是人的感受:参与者平均打了 7.2 分(满分 10 分),并且愿意把自己每年买书预算的三成左右交给代理去打理。
我觉得这个实验的关键在于,它把”代理替人办事”拆成了两件事:懂你,和替你谈。过去大家聊 AI 代理,焦点常常落在执行和谈判上,好像只要够会砍价就行。这次的结果反过来说明,瓶颈更可能卡在前面那一步。代理手里的偏好信息不够,谈判能力再强,也只是在一个没对准的方向上使劲。以后谁想做购物、比价这类代理产品,怎么在不烦人的前提下多了解用户一点,大概比优化谈判话术更要紧。
三成预算这个数字也挺微妙。人愿意放手,但只放一部分。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






让Claude替你去换书:Anthropic拿201名员工做了一场代理人集市实验