Claude Haiku 5.5 昨晚发布:价格砍到一折,subagent 干活成本崩了

北京时间昨天深夜,Anthropic 把 Claude 家族最便宜的模型换成了 Haiku 5.5:输入价 $0.10 每百万 tokens——上一代是 $1,直接砍到一折。
更有意思的是时间点。OpenAI 同一天在全网推 GPT-6,Anthropic 转头就把"干粗活"的模型价格打了一折。两家掐得有多凶,看发榜日历就行。
先看速览
| 事项 | 内容 |
|---|---|
| 发布时间 | 10 月 7 日 18:01 UTC(北京时间 8 日凌晨) |
| 官方定位 | 史上最便宜、最快、最强的自家小模型 |
| 价格 | ≤10 万 token 档:$0.10 输入 / $0.50 输出 |
| 上下文 | 100 万 tokens,最大输出 12.8 万 |
| 上架位置 | Claude API、Bedrock、谷歌云、Microsoft Foundry |
价格:不是降价,是重定价
先看数字,左边灰条是 Haiku 4.5,绿条是 5.5:

- 提示在 10 万 token 以内:输入 $1 → $0.10,输出 $5 → $0.50,就是 1/10;
- 超过 10 万 token:输入 $0.50、输出 $2.50,砍半;
- 缓存读取低到 $0.01,几乎可以忽略。
官方口径是"平均跑起来省约 75%"——没说 90% 是因为新模型的 tokenizer 会多消耗约 30% 的 token,折算完是这个数。但账不用替它算:单价挂在那里,1 折就是 1 折。
这已经不是降价,是把小模型重新定价成了"水电费"。
跑分:上代 0 分的卷子,它考了 39.2
官方评测表里最扎眼的一行是 Terminal-Bench 4.0(智能体编程):Haiku 4.5 得分 0.0%,Haiku 5.5 直接干到 39.2%。

规律很整齐:每一行都碾压上代 Haiku 和 GPT-6 Luna,每一行都差 Sonnet 5.5 一截。电脑操作 OSWorld 拿了 72.4%,只比自家老大哥低 11 个点。
这就是小模型定位成熟的标志:不是全面追旗舰,是在"够用"的活上做到旗舰八成、价格一成。
对 Claude Code 用户:subagent 的账彻底变了
Anthropic 官方给 Haiku 5.5 的定位写得明明白白:给 Opus 5.5 / Sonnet 5.5 当 subagent 干编码活。
用过 Claude Code 的都知道,主模型定方案,真正烧 token 的是底下那一群跑腿的——读文件、跑测试、扫日志、做摘要。这些活以前用 $1/$5 的 Haiku 干,现在换成 $0.10/$0.50,同样一批 subagent 任务,账单直接除以十。
还有两个同天上线的细节,别漏掉:
- Sonnet 5.5 缓存读取价格减半,官方说大多数智能体场景等于整体再便宜约 20%;
- Max 和 Team 订阅者送月度 API 额度,官方明说是给你开发智能体和应用用的。
另外这是第一个带 effort 档位的 Haiku(低到高五档,默认中档),想让更便宜或者更聪明,自己调。
干运维的怎么看
Haiku 官方列的适用场景——摘要、压缩(compaction)、数据库查询、分类请求——基本就是运维自动化的日常清单。告警降噪、日志归类、变更摘要这类"量大、单步简单"的活,以前接大模型心疼钱,接规则引擎又糙,现在这个价格档位正好补上。
客户反馈里 Asana 给的数字可以参考:任务完成延迟降 30%+,每轮智能体推理最快快 2.5 倍。
小模型打到这个价位,"要不要上 AI"的讨论该变成"哪些环节还不上"。
🎯 老张建议
- Claude Code 用户:把 subagent 模型显式切到 haiku-5-5,重活继续留给 Sonnet/Opus,先跑一周看账单差;
- 做自动化的:告警摘要、日志分类这类批处理场景现在值得重新算一遍 ROI,缓存读 $0.01 的价格可以放开跑;
- 别急着退订大模型:复杂智能体编程官方自己都说 Sonnet/Opus 仍是更优解,一折是干粗活的价格,不是全能的价格。
💬 互动话题
- 你 Claude Code 的 subagent 现在用的什么模型?换了之后省了多少?
- 小模型一折价,你有哪些"以前舍不得跑"的场景打算试试?
🔗 关注老张
公众号:老张聊运维 小程序:观简国学 个人博客:https://www.shanwaiyun.top/