9 月 22 日这天,Anthropic 和 OpenAI 的新模型隔了不到两小时先后放出来:一个是 Claude Opus 5.5,一个是 GPT-6 Sol,外加一个更便宜的 Luna。
距离 Opus 5 发布,才过去两个月。
价格是最直观的。Opus 5.5 的 API 是每百万 token 输入 4 美元、输出 20 美元,比 Opus 5 的 5 美元和 25 美元各降了 20%;缓存读取从 0.5 美元砍到 0.2 美元,降幅 60%,这一项对长对话、长代码库的用户影响最大。GPT-6 Sol 更狠,输入 2 美元、输出 10 美元,直接是上一代 GPT-5.6 Sol 的一半。Luna 则压到了 0.1 美元和 0.5 美元。
单看标价,Sol 只要 Opus 5.5 的一半。但这笔账不能只看单价。
Anthropic 宣传的“典型任务省 40%”,是拿 Opus 5.5 的默认 medium 档去比 Opus 5 的 high 档。同样的活、同样的档位,纯靠单价下降能省的其实就是 20% 左右,缓存吃得多的场景能到 29%。这个口径差,开发者迁移前最好自己跑一遍。
能力上,两家的侧重点也不同。Opus 5.5 在 Terminal-Bench 4.0 上拿了 66.4%,比自家更大更贵的 Fable 5.1 高出一截;第三方 Artificial Analysis 的综合指数里,Opus 5.5 是 51 分,GPT-6 Sol 默认档 40 分、开到最高推理档 48 分。编程类测试 Opus 5.5 明显领先,商务类任务两者几乎打平,Sol 还略高一点。
跑完这套测试,Opus 5.5 花了约 1.34 美元,Sol 只花了约 0.25 美元。
所以这次的格局挺清楚:要最好的编程和复杂推理,Opus 5.5 仍是更稳的选择;大批量、重复性的业务流程,Sol 的性价比很难忽视。
还有一个容易被忽略的变化在写作上。早期测试者普遍反馈 Opus 5.5 说话终于“像人”了,少了术语堆砌,重点放在开头。Anthropic 工程师在社交平台上解释过前几代的问题:后续模型大量训练了给其他 AI 写技术说明的任务,奖励机制又偏向数学和代码,结果写出来的东西更像写给机器看的。Opus 5.5 算是往回拉了一把,不过他也承认,能不能超过 Opus 4.6 那一代的文风,还不好说。
有个细节可以看出速度差:一家云服务商之前用 Opus 5 花了 24 小时做出一个可以四处走动的日本小镇场景,换 Opus 5.5 重做同样的东西,只用了 2 小时,项目已经开源。
两个月一代、价格腰斩,这种节奏如果持续下去,今年年初定下的 AI 预算,到年底可能已经对不上任何一个在售型号了。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






Opus 5.5和GPT-6 Sol前后脚上线,两家都在降价,但降法不一样