返回首页

Claude Fable 5.1 发布:缓存读取降价 75%,智能体任务最高省 45%

Claude Fable 5.1 发布:缓存读取降价 75%,智能体任务最高省 45%

Anthropic 9 月 1 日发布 Claude Fable 5.1:输入输出单价一分没涨,但缓存读取直接降价 75%,重度智能体任务官方估算最高能省 45%。

跑过 Claude Code 或者自建智能体应用的人,对账单结构应该不陌生。真正烧钱的往往不是模型"写"了什么,而是它每一轮都要"重读"什么——系统提示、历史上下文、整段代码文件,全部按缓存读取计费。这次 Anthropic 砍的正是这一刀。

📋 速览

项目内容
发布时间2026 年 9 月 1 日(当地时间)
模型Claude Fable 5.1(全面开放)/ Claude Mythos 5.1(受限开放)
API 模型 IDclaude-fable-5-1
上下文100 万 Token,最大输出 12.8 万 Token
API 定价输入 $10 / 输出 $50 每百万 Token(不变)
缓存读取$1.00 → $0.25 每百万 Token,降 75%
可用渠道Claude.ai、Claude Code、Claude API、AWS、Google Cloud、Azure

发生了什么

9 月 1 日,Anthropic 正式发布 Claude Fable 5.1 和 Claude Mythos 5.1。官方定位是"编程和知识工作领域最先进的模型"。

两个名字背后是同一个模型,差别只在防护栏强度:

  • Fable 5.1:全面开放,普通用户在 Claude.ai、Claude Code 里直接能用;
  • Mythos 5.1:只通过可信访问计划开放,面向网络安全和生命科学场景,具体包括网络安全验证计划(CVP)、生命科学验证计划(LSVP)和美国政府实验室能力计划(USG-LSC)。

为什么同一个模型要拆两个版本?官方解释是:旧版安全护栏在编程类任务上误伤太多,Mythos 5.1 和 Fable 5.1 的跑分差距(60.9% vs 55.8%)主要来自护栏干预,不是能力差异。新护栏上线后,这个差距预计会明显缩小。

关键变化

跑分:对自家前代是碾压

官方公布的对比数据(供应商自报,仅供参考):

测试Fable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench 4.0(智能体终端编程)55.8%42.0%52.3%37.3%
Terminal-Bench-Science 0.1(智能体科研)52.6%24.7%29.0%22.4%
GDPval-AA v2(知识工作)185317231824
CursorBench 3.2.073.4%70.6%

"人类最后考试"(HLE)从 57.8% 提到 60.9%,自动化办公基准 AutomationBench 从 17.1% 跳到 31.4%。

还有个值得单独说的实测:投资公司 Millennium 用 Fable 5.1 排查内部系统的一个罕见崩溃,模型找到了根本原因——这个问题他们自己的工程师追了好几年,其他模型也没解出来。

价格:明面不变,暗处大降

输入 $10、输出 $50 每百万 Token,和 Fable 5 完全一致。缓存写入($12.50 / $18.75)也没动。

变的是缓存读取:从 $1.00 降到 $0.25 每百万 Token,降幅 75%。

官方估算:普通工作负载整体便宜约 25%,高度智能体化的任务最高便宜约 45%。

对跑长会话、多轮工具调用的场景,这才是真正影响账单的部分。跑分是给媒体看的,缓存价格才是给运维看的。

企业隐私:EFS 把数据放回客户自己手里

新推出的企业前沿防护(EFS)机制,做法是把数据存到客户完全控制的云基础设施里,而不是 Anthropic 的侧。今年秋季开始分阶段向企业客户开放;过渡期符合条件的客户可以直接以零数据保留方式使用 Fable 5.1。

安全护栏:误报少了,边界更清楚

网络安全方向,新护栏误报减少 60%。更关键的是边界重画:

Fable 5.1 现在可以帮你发现软件漏洞——但不能帮你开发漏洞利用工具。

"能找洞,不造武器",这是官方第一次把这种边界当成产品卖点来写。另外输出会加不可见水印,并提供内容来源验证 API(目前私有预览),摆明是为欧盟 AI 法案合规铺路。

API 用户注意:三个破坏性变更

迁移 claude-fable-5-1 之前,这三条必须看:

  1. 强制工具调用(forced tool use)现在会直接返回错误,不再静默处理;
  2. 早期模型读不了 Fable 5.1 生成的思考块(thinking blocks);
  3. 编辑对话历史中较早的轮次,会使之前生成的思考块失效。

同时新增了五个能力,比较实用的有:单条消息级别设置 effort(beta)、单轮生效的系统消息(beta)、工具调用之间插播进度更新(beta,display 设为 "updates")。

还有一个动作值得留意:新注册的 API 账户将禁止编辑 Claude 之前的思考上下文——官方说法是防止蒸馏滥用。

对普通开发者的影响

Claude Code 用户:Fable 5.1 默认 effort 是 high(Claude Cowork 和 Claude.ai 里是 medium)。订阅档位不变,Pro / Max / Team / Enterprise 都能用。

API 用户:单价没变,省不省钱取决于你的缓存命中率。长会话、重复上下文多的智能体工作流受益最大;一次性问答类的调用,基本无感。

选型上,Anthropic 自己的建议没变:大多数工作负载先从 Opus 5 起步,要求更高的再上 Fable 5.1。它在 Haiku、Sonnet、Opus 之上,是新的旗舰档。

其他细节:知识截止 2026 年 6 月;退役时间不早于 2027 年 9 月 1 日;强制美国本土推理需加 10% 费用。

应该怎么做

  1. Claude Code / Claude.ai 用户:直接用,不用改配置,留意 effort 默认是 high,简单任务可以手动降下来省钱;
  2. API 用户:迁移前过一遍上面三个破坏性变更,特别是用到了 thinking blocks 或历史编辑的应用;
  3. 对数据合规敏感的企业:关注 EFS 的秋季开放节奏,过渡期先用零数据保留。

老张判断

这次发布真正的信号不在跑分。输入输出单价冻结、缓存读取砍 75%、EFS 把数据主权还给客户——三件事指向同一个方向:前沿模型的竞争点,正从"谁更聪明"转向"谁的智能体账单更能打"。

能力涨、价格不涨,2026 年敢这么发模型的厂商已经不多了。


🎯 老张建议

  • 正在用 Claude Code 的,Fable 5.1 直接切,长会话账单大概率肉眼可见变瘦;
  • 自建智能体应用的,先盘点缓存读取在账单里的占比,占比越高这次升级越值;
  • 别急着全量迁:先在非关键任务上验证三个破坏性变更的影响面。

💬 互动话题

  • 你的智能体应用账单里,缓存读取占多大比例?
  • "能找漏洞但不能开发利用工具"这种边界,你觉得是保护还是束缚?
  • 现在选模型,你更看重跑分还是综合使用成本?

🔗 关注老张

公众号:老张聊运维 小程序:观简国学 个人博客:https://www.shanwaiyun.top/

A

Admin

用文字记录生活与思考。

评论 (0)
暂无评论,来抢沙发吧
Claude Fable 5.1 发布:缓存读取降价 75%,智能体任务最高省 45% | 山外云的Vlog