产品简介
Claude Haiku 5.5 是 Anthropic 在 2026 年 10 月 7 日发布的小模型,官方给它的定位是迄今最便宜也最快。最抓眼球的是价格:100K token 以内的请求输入每百万 0.10 美元、输出 0.50 美元,正好是上一代 Haiku 4.5 的十分之一,也和 OpenAI 的 GPT-6 Luna 站在同一档。超过 100K token 之后价格抬到五倍,输入 0.50、输出 2.50,但即便这样仍比 Haiku 4.5 便宜一半。
降价只是这次发布的一半。另一半是能力:Haiku 4.5 在编程和电脑操作上的成绩几乎是空白,Terminal-Bench 4.0 得 0 分,OSWorld 只有 15.7%,Haiku 5.5 把这两项分别提到 39.2% 和 72.4%。它还是第一款带可调推理档位的 Haiku 模型,从 Low 到 Max 共五档,默认 Medium,想多花点计算换效果就往上拨。对每天要跑成千上万次调用的团队来说,这次更像是把小模型从凑合能用推到了挑得起活。
核心功能
- 按 100K 分档的定价:100K token 以内输入 $0.10/M、输出 $0.50/M,缓存读取只要 $0.01/M、缓存写入 $0.125/M,批量请求再打对折。超过 100K 之后整体涨到五倍。Anthropic 说 Haiku 4.5 大约九成的请求都在 100K 以下,所以对多数用户来说就是直接便宜一个数量级
- 五档可调推理:Low、Medium、High、xhigh、Max 五档,默认 Medium。档位越高投入的计算越多,效果通常更好,token 消耗也跟着涨。Artificial Analysis 的实测是每上一档智能指数加两到四分、成本乘以 1.6 到 1.7:Medium 得 34 分花 0.047 美元一个任务,Max 得 43 分花 0.213 美元
- 1M 上下文与 128K 输出:上下文窗口 100 万 token,标准模式最大输出 128K,批量模式目前以 beta 形式给到 300K。知识截止 2026 年 6 月。文本之外也吃图像
- 编程和电脑操作补上来了:Terminal-Bench 4.0 从 Haiku 4.5 的 0 分提到 39.2%,OSWorld 2.1 离线子集从 15.7% 提到 72.4%。带工具时 Humanity's Last Exam 得 57.4%,上一代是 18.7%。复杂智能体编程官方仍建议交给 Sonnet 5.5 和 Opus 5.5
- 给大模型当子智能体:官方给它安排的主战场是量大、看重速度、对极致精度要求不苛刻的活:摘要、压缩、分类、数据库查询、实时客服、浏览器操作。也可以挂在 Opus 5.5 和 Sonnet 5.5 下面做编码子智能体,把抽数据这类前置步骤从贵的模型上摘下来
- 铺开的可用渠道:Claude API 上的模型名是 claude-haiku-5-5,同时在 Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上架,Claude Code 里也有。从免费套餐到 Enterprise 各档都能用,Claude Code v2.1.293 起还把它设为默认的 Haiku 模型
适合谁用
以下类型的用户会特别受益于 Claude Haiku 5.5:
- 每天跑几万次的分类、抽取和摘要流水线,之前因为单价太高只能抽样跑
- 给 Sonnet 5.5 或 Opus 5.5 当子智能体,让贵的模型只做规划和收尾
- 实时客服和浏览器操作这类对首字延迟敏感的场景
- 大批量的文档压缩与数据库查询,配合批量接口再省一半
优点亮点
- 100K 以内价格降到上一代的十分之一,长上下文档位也仍便宜一半
- 编程与电脑操作从几乎为零提到可用的水平,小模型第一次能接这类活
- 可调推理档位让同一个模型在省钱和要好之间自己选
- 1M 上下文配 128K 输出,长文档处理没有明显短板
- 发布当天就铺满了三大云与 Claude Code,不需要等渠道跟进
- 订阅用户还拿到月度 API 额度,等于把订阅费换成可以自由调用的预算
价格与方案
按 token 计费,100K token 以内的请求输入 $0.10/M、输出 $0.50/M,缓存读取 $0.01/M、缓存写入 $0.125/M;超过 100K token 的输入 $0.50/M、输出 $2.50/M,缓存读取 $0.05/M、缓存写入 $0.625/M。批量接口价格在标准价上打五折。Claude 的免费到 Enterprise 各档套餐都能用到它,Max 5x 与 Max 20x 订阅者每月分别获赠 100 和 200 美元的 Platform API 额度,Team 套餐最多 500 美元可由团队共享,额度当月有效不滚存,可用于平台上任何模型。
总结与建议
Haiku 5.5 值得关注的地方不是它有多强,而是它在什么价位上变得多能用。小模型过去是拿价格换效果的妥协品,这次 Anthropic 把价格砍到和对手齐平的同时,把编程、电脑操作这些明显拖后腿的项目补到了能干活的水平,于是它第一次有了独立承担一类工作的资格。
真正需要想清楚的是两件事。第一是 100K 这条线:多数请求在线下,一旦检索流程稳定落在 120K 到 180K,账单会比宣传口径难看不少,路由时最好按提示词长度分一下。第二是档位:Medium 是默认也是性价比起点,分类路由这类短平快的活没必要往上拨,抽取乱七八糟的文档或者要多轮工具调用时才轮到 High 和 xhigh。
它也有明确的天花板。事实知识是薄的一块,需要百科式准确度的任务还得往上走;自动化类基准上得分偏低,评测机构判断可能和安全策略的过度拒绝有关,官方说在修。拿它当主力推理模型会失望,拿它当流水线上的工人模型,它现在的性价比确实很难找到对手。
版本演进
- Haiku 5.5 发布 (2026-10-07):Anthropic 发布 Claude Haiku 5.5,定位迄今最便宜也最快的模型:100K token 以内输入 $0.10/M、输出 $0.50/M,为 Haiku 4.5 的十分之一,超过 100K 为 $0.50/$2.50;1M 上下文、最高 128K 输出,首次提供 Low 到 Max 五档可调推理(默认 Medium);Terminal-Bench 4.0 从 0 分升至 39.2%,OSWorld 2.1 离线子集从 15.7% 升至 72.4%,Artificial Analysis 智能指数 Max 档 43 分;同日下调 Sonnet 5.5 缓存读取价至 $0.10/M,并为 Max 与 Team 订阅推出月度 Platform API 额度;已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 与 Claude Code 上线