Claude Haiku 5.5 发布:最便宜的一档,干了最多的活
10 月 7 日,Anthropic 发布 Claude Haiku 5.5(模型 ID claude-haiku-5-5),全平台即刻可用(AWS、Google Cloud、Azure 与 Claude 平台)。官方定位是「我们发布过的最便宜、最快、最强的小模型」。至此,5.5 系列三档——Opus 5.5(9/22)、Sonnet 5.5(9/28)、Haiku 5.5——全部集齐。
价格:直接砍到上一代的四分之一
新定价按提示长度分两档(≤100k tokens / 更长):
| 项目 | Haiku 5.5 | Haiku 4.5 |
|---|---|---|
| 输入 | $0.10 / $0.50 | $1.00 |
| 输出 | $0.50 / $2.50 | $5.00 |
| 缓存读取 | $0.01 / $0.05 | — |
官方口径:综合成本比 Haiku 4.5 低约 75%,其中 10 万 token 以内的请求(占上一代用量的约九成)便宜 90%。配套还有一条容易被忽略的实惠:Sonnet 5.5 缓存读取降至 $0.10(半价),官方估算典型 agent 工作流总成本可降约 20%。
能力:小模型的身子,干活的命
基准提升是全面性的:Humanity's Last Exam 从 4.5 代的 10.2% 提到 45.9%(带工具 57.4%);Terminal-Bench 4.0 从 0% 到 39.2%;OSWorld(离线子集)从 15.7% 到 72.4%。最有信号量的一条:FrontierCode 1.1 拿到 46.4%,高于 GPT-6 Luna 的 42.4%——轻量档第一次在这个榜单上越级压制对手的轻量档。
它还是首个支持 effort 分档(Low 到 Max)的 Haiku 级模型:简单任务压低档位省钱,难任务放开档位提智。SDK 同步新增 computer-use 与 browser-use 的 beta 支持。
生态位置:给 agent 军团配「工蜂」
Anthropic 明确把它定位为 Opus/Sonnet 5.5 旁边的子代理:摘要、压缩、数据库查询、分类、在线客服、浏览器操作这类高频低难度的活都交给它,复杂编码与长链路 agent 仍留给大哥们。第三方已经用脚投票——Cognition 披露 Devin Fusion 搭配 Haiku 5.5 做副手,FrontierCode 达到 66.2 的顶级分数,同时成本与延迟双降。
此外,Claude 订阅线新增月度 API 额度:Max 5x 每月 $100、Max 20x $200、Team 可池化至 $500——订阅与 API 的边界正在打通。
对企业的启示
小模型的价格战打到「九成用量便宜九成」,意味着绝大多数 agent 场景的成本模型要重算:以前因为 API 账单做不下去的批量处理、全天候客服、文档抽取,现在值得重新立项。务实建议是按「任务难度路由」设计架构——Haiku 5.5 处理八成日常请求,Sonnet/Opus 只接高难度决策,混合成本可压到纯旗舰方案的一到两成。ProMen 在为企业搭建 AI+ 应用时同样遵循这一分层原则,欢迎交流落地经验。