三档梯队的最后一档,八天后换岗

Anthropic 于 10 月 7 日发布 Claude Haiku 5.5,接口标识 claude-haiku-5-5,同步登陆 Claude API、亚马逊云科技 Bedrock、谷歌云 Vertex AI、微软 Foundry 与 Azure。至此,9 月底以来陆续到位的 Claude 5.5 家族三档——旗舰 Opus、中档 Sonnet、高吞吐 Haiku——全部落地。本站 026 号稿此前记录过 Sonnet 5.5 发布时「面向高吞吐场景的 Haiku 5.5 已宣布在途」,这次算是兑现;兑现方式相当激进:上一代 Haiku 4.5 定于 10 月 15 日直接退役,生产团队只有八天窗口完成迁移与重测,官方承诺 5.5 这一代至少服务到 2027 年 10 月。

价格账本:两大实验室分毫不差地撞在同一个数字上

定价是这轮发布里最值得多看两眼的数字。10 万词元以内的提示词,输入 0.10 美元、输出 0.50 美元每百万词元,缓存读取 0.01 美元——这与 OpenAI 9 月下旬为小模型 GPT-6 Luna 设下的牌价完全一致;上一代 Haiku 4.5 还是 1 美元与 5 美元,名义降幅达九成。两大实验室在互不通气的情况下把小模型价格钉在同一档,与其说是巧合,不如说这已经是算出来的地板价:再往下,高吞吐推理的毛利撑不住,再往上,客户就流向对手。超过 10 万词元后 Haiku 5.5 直接跳到五倍价(0.50 与 2.50 美元),而 Luna 要到 27.2 万词元才升档、且只升到 0.20 与 0.75 美元——按两家牌价复算,一条 15 万词元的长提示词在 Luna 那边反而更便宜。边界条件不同,比价要看自己的负载落在哪一段。

Haiku 5.5:价格与 GPT-6 Luna 分毫不差10 万词元以内输入 0.10 / 输出 0.50 美元每百万词元 · 缓存读 0.01与 GPT-6 Luna 同价10 万词元以上五倍价 0.50 / 2.50 美元Luna 到 27.2 万才升档对比上一代Haiku 4.5 为 1 / 5 美元 · 名义降 90%10 月 15 日退役官方平均口径新分词器多计约四分之一词元 · 平均省约 75%第三方提醒隐性涨价基准成绩OSWorld 2.1 15.7% 跃至 72.4% · Terminal-Bench 39.2%均为 Anthropic 自报规格1M 上下文 · 128K 输出 · effort 五档默认 medium · 可用至 2027 年 10 月
Haiku 5.5 定价阶梯与基准成绩(Anthropic 定价页与系统卡口径)

分词器的隐性涨价:降幅没有账面那么大

有一个容易被牌价掩盖的细节:Haiku 5.5 换了分词器,同一段文本切出的词元比上一代多约四分之一到三成。独立开发者西蒙·威利森在实测中把这点称为隐藏涨价——单价降九成的另一面,是每个任务消耗的计费单位变多。Anthropic 自己的官方估算因此保守得多:结合约九成请求本就落在 10 万词元以内这一分布,平均成本降幅约为 75%,而非字面上的 90%。给采购者的提醒很直接:算每任务成本,别算每词元成本,迁移前拿真实流量回放一遍再下结论。配套的迁移坑位还有两处:非默认的 temperature、top_p 或 top_k 取值会直接报错,优先级档(Priority Tier)暂不支持,依赖这两项的调用需要改造。

基准跳幅很大,但口径全是厂商自报

成绩单上的跳幅相当醒目:操作系统操作基准 OSWorld 2.1 离线子集从上一代的 15.7% 升到 72.4%,同价位的 GPT-6 Luna 是 48.9%;终端任务基准 Terminal-Bench 4.0 从 0% 升到 39.2%,同样高于 Luna 的 16.4%,但仍明显落后于自家 Sonnet 5.5 的 70.6%;人类最后考试(HLE)无工具 45.9%、带工具 57.4%;GDPval-AA v2.1 得分 1620,高于 Luna 的 1437 与上一代的 735。第三方榜单方向一致但幅度温和:Artificial Analysis 智能指数给到最高档 43、默认档 34,上一代带推理为 17。需要强调,上述基准全部出自 Anthropic 系统卡自报,独立复测尚未出现;官方对 Sonnet 与 Opus 的推荐语也写明,复杂的编码任务仍应交给中档与旗舰。

规格与定位:把便宜的那档做「够用」

规格面,Haiku 5.5 上下文窗扩到 100 万词元、输出上限 12.8 万(批处理测试期可到 30 万),是 Haiku 系列里头一回配备可调 effort 档位的型号——低到 max 共五档,默认中等,自适应思考默认开启且无法关闭。官方给的用武之地是高吞吐文档问答、摘要、分类与数据库查询这类重复性负载,以及在更大的模型旁边充当轻量搭档:大模型做规划,便宜的那档跑批量小活。这个定位与本站智能体资讯线此前记录的「把子任务路由给廉价档」的行业趋势相互印证——小模型的价值正在从独立答题转向流水线里的密集工位。Anthropic 同时把 Sonnet 5.5 的缓存读取价减半到 0.10 美元,并给 Max 与 Team 订阅者发放月度 API 额度,等于对存量高用量客户做了一轮定向让利。

同价撞车之后,下一轮比什么

把这条放进大盘看:一周之内,GPT-6 Luna 与 Haiku 5.5 先后把小模型牌价钉死在 0.10 与 0.50 美元,中档市场也有 GPT-6.1 Sol、Sonnet 5.5 与 Gemini 4 Argon 三方在同一价位缠斗——价格层级的公共坐标系已经成形,接下来能拉开差距的只剩三样:单位任务的真实成本(分词器与缓存策略都算在内)、在基准之外的可验证可靠性,以及平台折扣与额度体系。对用户这是实打实的红利;对模型厂商,这意味着高吞吐档从利润区变成了地基,钱得从别处挣。官方及行业暂未披露更多细节,后续将持续跟进迭代动态。