Anthropic 9 月 1 日上线 Claude Fable 5.1,模型 ID 是 claude-fable-5-1,接的是 Fable 5 的位置。
官方放出来的基准测试对比是这样的——Terminal-Bench-Science 0.1 上 Fable 5.1 拿到 52.6%,Fable 5 是 24.7%、Opus 5 是 29.0%,比上一代高出一倍多;Terminal-Bench 4.0 的 agent 编程 55.8%(只对受邀用户开放的 Mythos 5.1 是 60.9%);AutomationBench 的业务流程 31.4%,对照 Fable 5 的 17.1%。

涨得最猛的两栏都是 agent 类任务。反过来看常规知识工作那栏,GDPval-AA v2 上 1853 对 Opus 5 的 1824,只差 29 分;OSWorld 2.0 严格口径 41.7% 对 39.6%,Humanity’s Last Exam 带工具 65.0% 对 63.6%,差距都在两个点以内。这个分布正好对上官方那句”多数负载先用 Opus 5″——单轮问答和普通知识工作它拉不开身位,钱要花在长周期、多步骤的活儿上才值。
价格没动:输入 10 美元每百万 token,输出 50 美元每百万 token,跟上一代一模一样。1M 上下文、128K 最大输出也照旧。真正变了的是缓存那一栏。
缓存读取降到 0.25 美元每百万 token。作为对照,Claude 系列的常规缓存读取价是基础输入价的 10%,也就是 1 美元,现在是它的四分之一。5 分钟缓存写入 12.5 美元、1 小时缓存写入 20 美元,批处理 API 照旧打五折。
这个降价对什么人有意义,取决于你怎么用它。
一次性问答的用户基本感觉不到;反过来,长周期 agent 那种把几十万 token 的上下文反复重读的场景,缓存读取是账单的大头。同样一个 800K token 的工作区,每轮重读一次,按旧价一轮 0.8 美元,现在是 0.2 美元。跑一天下来差的就不是零头了。定价改成这样,等于官方直说了这个模型是给长任务用的。
三个破坏性变更需要注意,从 Fable 5 迁过来的代码可能会直接炸:
第一,强制工具调用(forced tool use)不再支持,传了会返回错误。第二,更早的模型读不了它产出的 thinking block——思考块和产生它的模型绑定了。第三,编辑历史轮次会让 thinking block 失效。后两条对做多模型路由的人比较麻烦:以前可以让便宜模型接着贵模型的思考往下走,现在这条路断了。
新增的五样里,有三样带 beta 标记。按消息调 effort,可以在对话中途改思考强度而不作废 prompt 缓存;轮次级 system message,允许给单轮加临时指令;还有工具调用之间的可读进度更新(display: "updates"),让长任务跑的时候界面上有东西可看,而不是一片空白等十分钟。剩下两样是前面说的缓存降价,和内容溯源(content provenance)。
其余规格:知识截止 2026 年 6 月,自适应思考常开且关不掉,默认 effort 是 high,延迟官方标的是”较慢”,输入支持文本和图像。退役承诺不早于 2027 年 9 月 1 日。
官方自己给的选型建议挺实在:多数负载先上 Claude Opus 5,那个是 5 美元和 25 美元,正好一半价,同样 1M 上下文;只有在 Opus 5 开到更高 effort 还是不够的时候,再换 Fable 5.1。这话翻过来读就是——别默认用最贵的那个。
上架平台一次给全:Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS。
另外还有个只在邀请名单里的 Claude Mythos 5.1,规格和定价跟 Fable 5.1 完全一样,属于 Project Glasswing,需要通过 Anthropic、AWS 或者 Google Cloud 的客户团队申请。同一套能力开两条通道,一条公开一条受邀。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






Claude Fable 5.1 发布:价格一分没涨,缓存读取砍到四分之一,代价是强制工具调用被拿掉了