Claude Fable 5.1 发布:缓存读取降价 75%,智能体任务最高省 45%

Anthropic 9 月 1 日发布 Claude Fable 5.1:输入输出单价一分没涨,但缓存读取直接降价 75%,重度智能体任务官方估算最高能省 45%。
跑过 Claude Code 或者自建智能体应用的人,对账单结构应该不陌生。真正烧钱的往往不是模型"写"了什么,而是它每一轮都要"重读"什么——系统提示、历史上下文、整段代码文件,全部按缓存读取计费。这次 Anthropic 砍的正是这一刀。
📋 速览
| 项目 | 内容 |
|---|---|
| 发布时间 | 2026 年 9 月 1 日(当地时间) |
| 模型 | Claude Fable 5.1(全面开放)/ Claude Mythos 5.1(受限开放) |
| API 模型 ID | claude-fable-5-1 |
| 上下文 | 100 万 Token,最大输出 12.8 万 Token |
| API 定价 | 输入 $10 / 输出 $50 每百万 Token(不变) |
| 缓存读取 | $1.00 → $0.25 每百万 Token,降 75% |
| 可用渠道 | Claude.ai、Claude Code、Claude API、AWS、Google Cloud、Azure |
发生了什么
9 月 1 日,Anthropic 正式发布 Claude Fable 5.1 和 Claude Mythos 5.1。官方定位是"编程和知识工作领域最先进的模型"。
两个名字背后是同一个模型,差别只在防护栏强度:
- Fable 5.1:全面开放,普通用户在 Claude.ai、Claude Code 里直接能用;
- Mythos 5.1:只通过可信访问计划开放,面向网络安全和生命科学场景,具体包括网络安全验证计划(CVP)、生命科学验证计划(LSVP)和美国政府实验室能力计划(USG-LSC)。
为什么同一个模型要拆两个版本?官方解释是:旧版安全护栏在编程类任务上误伤太多,Mythos 5.1 和 Fable 5.1 的跑分差距(60.9% vs 55.8%)主要来自护栏干预,不是能力差异。新护栏上线后,这个差距预计会明显缩小。
关键变化
跑分:对自家前代是碾压
官方公布的对比数据(供应商自报,仅供参考):
| 测试 | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0(智能体终端编程) | 55.8% | 42.0% | 52.3% | 37.3% |
| Terminal-Bench-Science 0.1(智能体科研) | 52.6% | 24.7% | 29.0% | 22.4% |
| GDPval-AA v2(知识工作) | 1853 | 1723 | 1824 | — |
| CursorBench 3.2.0 | 73.4% | 70.6% | — | — |
"人类最后考试"(HLE)从 57.8% 提到 60.9%,自动化办公基准 AutomationBench 从 17.1% 跳到 31.4%。

还有个值得单独说的实测:投资公司 Millennium 用 Fable 5.1 排查内部系统的一个罕见崩溃,模型找到了根本原因——这个问题他们自己的工程师追了好几年,其他模型也没解出来。

价格:明面不变,暗处大降
输入 $10、输出 $50 每百万 Token,和 Fable 5 完全一致。缓存写入($12.50 / $18.75)也没动。
变的是缓存读取:从 $1.00 降到 $0.25 每百万 Token,降幅 75%。
官方估算:普通工作负载整体便宜约 25%,高度智能体化的任务最高便宜约 45%。
对跑长会话、多轮工具调用的场景,这才是真正影响账单的部分。跑分是给媒体看的,缓存价格才是给运维看的。
企业隐私:EFS 把数据放回客户自己手里
新推出的企业前沿防护(EFS)机制,做法是把数据存到客户完全控制的云基础设施里,而不是 Anthropic 的侧。今年秋季开始分阶段向企业客户开放;过渡期符合条件的客户可以直接以零数据保留方式使用 Fable 5.1。
安全护栏:误报少了,边界更清楚
网络安全方向,新护栏误报减少 60%。更关键的是边界重画:
Fable 5.1 现在可以帮你发现软件漏洞——但不能帮你开发漏洞利用工具。
"能找洞,不造武器",这是官方第一次把这种边界当成产品卖点来写。另外输出会加不可见水印,并提供内容来源验证 API(目前私有预览),摆明是为欧盟 AI 法案合规铺路。
API 用户注意:三个破坏性变更
迁移 claude-fable-5-1 之前,这三条必须看:
- 强制工具调用(forced tool use)现在会直接返回错误,不再静默处理;
- 早期模型读不了 Fable 5.1 生成的思考块(thinking blocks);
- 编辑对话历史中较早的轮次,会使之前生成的思考块失效。
同时新增了五个能力,比较实用的有:单条消息级别设置 effort(beta)、单轮生效的系统消息(beta)、工具调用之间插播进度更新(beta,display 设为 "updates")。
还有一个动作值得留意:新注册的 API 账户将禁止编辑 Claude 之前的思考上下文——官方说法是防止蒸馏滥用。
对普通开发者的影响
Claude Code 用户:Fable 5.1 默认 effort 是 high(Claude Cowork 和 Claude.ai 里是 medium)。订阅档位不变,Pro / Max / Team / Enterprise 都能用。
API 用户:单价没变,省不省钱取决于你的缓存命中率。长会话、重复上下文多的智能体工作流受益最大;一次性问答类的调用,基本无感。
选型上,Anthropic 自己的建议没变:大多数工作负载先从 Opus 5 起步,要求更高的再上 Fable 5.1。它在 Haiku、Sonnet、Opus 之上,是新的旗舰档。
其他细节:知识截止 2026 年 6 月;退役时间不早于 2027 年 9 月 1 日;强制美国本土推理需加 10% 费用。
应该怎么做
- Claude Code / Claude.ai 用户:直接用,不用改配置,留意 effort 默认是 high,简单任务可以手动降下来省钱;
- API 用户:迁移前过一遍上面三个破坏性变更,特别是用到了 thinking blocks 或历史编辑的应用;
- 对数据合规敏感的企业:关注 EFS 的秋季开放节奏,过渡期先用零数据保留。
老张判断
这次发布真正的信号不在跑分。输入输出单价冻结、缓存读取砍 75%、EFS 把数据主权还给客户——三件事指向同一个方向:前沿模型的竞争点,正从"谁更聪明"转向"谁的智能体账单更能打"。
能力涨、价格不涨,2026 年敢这么发模型的厂商已经不多了。
🎯 老张建议
- 正在用 Claude Code 的,Fable 5.1 直接切,长会话账单大概率肉眼可见变瘦;
- 自建智能体应用的,先盘点缓存读取在账单里的占比,占比越高这次升级越值;
- 别急着全量迁:先在非关键任务上验证三个破坏性变更的影响面。
💬 互动话题
- 你的智能体应用账单里,缓存读取占多大比例?
- "能找漏洞但不能开发利用工具"这种边界,你觉得是保护还是束缚?
- 现在选模型,你更看重跑分还是综合使用成本?
🔗 关注老张
公众号:老张聊运维 小程序:观简国学 个人博客:https://www.shanwaiyun.top/