📄

Claude Haiku 5.5 发布:与 GPT-6 Luna 同价,10万token内降价90%

2026-10-08 08:44 👁 0 阅读

🏷️ 标签

https://www.anthropic.com

【摘要】

第一,Anthropic 把自家体量最小、最便宜的 Haiku 线直接拉到和 GPT-6 Luna 一个价——输入 0.10、输出 0.50(美元/百万 token),这是小模型价格战里少见的正面硬刚,而不是在自己舒适区里悄悄打折。

第二,这一定价的前提是“10 万 token 以内较前代降价 90%”,等于把前代在同区间的价格砍到约十分之一;超过这个区间怎么计费,发布信息没有展开,这是读这条新闻时最容易漏掉的边界。

第三,Haiku 5.5 第一次给了“可调推理强度”,再配上 1M 上下文,意味着小模型不再只是“快而浅”的转发器,也能在被允许时多想一会儿、多看一遍。

第四,它的定位被明确写成“干杂活的子智能体”——也就是被主模型派出去跑流程、抓数据、做整理的那个后台角色,这恰恰是最吃调用频次、最在意单价的场景。

第五,把最小号打到和对手中坚同价,真正的信号不在“便宜”本身,而在 Anthropic 想用 Haiku 去抢“子智能体经济”的入口,也就是 AI 编排里最常被调用的那一层的地基。

一、事件描述

下表按发布方披露信息梳理本次发布可确认的事实与口径边界,凡是未独立核实具体公告页的,都标在最后一列。

| 事项 | 来源 | 已确认关键事实 | 口径边界/待核实 | | 发布与定位 | 官方发布(2026-10-07) | 推出 Claude Haiku 5.5,定位“干杂活的子智能体” | 公告页具体 URL 未独立核实 | | 价格 | 官方发布信息 | 输入 0.10、输出 0.50 美元/百万 token,与 GPT-6 Luna 完全同价 | 以各官方定价页为准 | | 降价幅度 | 官方发布信息 | 10 万 token 以内较前代降价 90% | “前代”版本与超区间价未给出 | | 推理强度 | 官方发布信息 | 首次支持可调推理强度 | 档位数与默认档未公开 | | 上下文 | 官方发布信息 | 支持 1M 上下文 | 长上下文下的实际表现待第三方评测 | | 对比对象 | 发布方口径 | GPT-6 Luna 为同价参照 | GPT-6 Luna 定价以对方官方为准 |

二、Haiku 这条线,为什么突然开始拼价格

Haiku 一直是 Claude 家族里最轻的一档:低单价、低延迟,适合那些“量大、单次不复杂”的任务。过去它的卖点是便宜和快,而不是能力天花板。5.5 这代把价格直接对标 GPT-6 Luna,等于主动把“便宜”这张牌打到了对手中坚产品的门口——不是在自己舒适区降价,而是跨档位抢人。

值得注意,官方给的对标口径是“完全同价”,输入 0.10、输出 0.50,没有任何“我们更便宜”的措辞,而是强调“一样价”。这在价格战里是一种很直接的姿态:把选择交给能力、上下文和生态,而不是交给单价。对开发者来说,这意味着如果两家能力接近,迁移成本里最敏感的那一项——每百万 token 的账单——已经先被抹平了。

三、降价 90% 的口径:只覆盖 10 万 token 以内

发布信息里最容易误读的是“降价 90%”。准确说,这是在“10 万 token 以内”这一区间、相对前代而言的降幅。换句话说,前代在同样区间内大约贵十倍;新价把这个区间的价格压到了 0.10/0.50。

问题在于,超过 10 万 token 的部分怎么计费,发布信息没有展开。对多数子智能体场景——短指令、短上下文、高频调用——10 万 token 基本够用;但凡是涉及长文档搬运、长链路推理的任务,超区间定价才是真正的成本决定项。下表把已确认的价格关系摆清楚。

| 口径 | Claude Haiku 5.5 | GPT-6 Luna(对比) | 前代 Haiku | | 输入价(美元/百万 token) | 0.10 | 0.10 | 约 10 倍于新价(发布方口径) | | 输出价(美元/百万 token) | 0.50 | 0.50 | 约 10 倍于新价(发布方口径) | | 适用区间 | 10 万 token 以内 | 以对方定价页为准 | — | | 相对前代降幅 | 较前代降 90% | — | 基准 |

表:Haiku 5.5 与 GPT-6 Luna 同价关系及前代降幅(依据 2026-10-07 官方发布信息整理,前代具体历史价以官方为准)

四、可调推理强度 + 1M 上下文:小模型也能“想久一点”

如果说降价是抢入口,那“可调推理强度”和“1M 上下文”就是给入口配的承重墙。过去小模型的默认设定是“快答、浅答”;给一个可调的推理强度,意味着同一次调用里,简单任务走轻档、复杂任务走重档,用户能按成本换质量,而不是被一个固定档位绑架。

1M 上下文则让 Haiku 第一次能装下一整份长文档、一整套流程上下文,而不必频繁切片、反复重传。对子智能体来说,这两者组合的意义在于:它终于不只是“转发器和格式化器”,而能在本地多想一步、多看一遍,再把手里的活交回去。

图:Haiku 5.5 与 GPT-6 Luna 输入单价对比(每百万 token,美元;1 格 = 0.10)

GPT-6 Luna        █         0.10
Claude Haiku 5.5  █         0.10

说明:条形按 0.10 美元/格绘制;两模型在 10 万 token 以内输入价完全一致,故条形等长。前代 Haiku 据发布信息贵约 10 倍,具体历史价以官方为准,此处不画以免超出已确认口径。价格在 10 万 token 以内以官方发布信息为基准。

五、定位“干杂活的子智能体”:抢的是调用频次

“干杂活的子智能体”这个说法很直白——它指的不是主对话里那个被你问东问西的助手,而是被主模型派出去跑腿、抓取、整理、调接口的那个后台角色。这类角色的调用特征是高频、低单次价值、对延迟和单价极敏感:一次编排里可能要调它几十次,每次就处理一小段文本。

把最小号打到和对手中坚同价,等于在这个最吃频次的场景里,先把单价这张牌压到最低;再叠加 1M 上下文与可调推理,让子智能体既能多想、又能多看。Anthropic 想占据的,未必是“最强模型”的心智,而是“最常被调用模型”的事实入口。当一个 AI 系统的成本越来越多地由后台子智能体决定,谁拿下单价和上下文,谁就拿下了 AI 编排时代的地基。

六、结语

Claude Haiku 5.5 的发布,关键点不在单点能力,而在于定位组合:与 GPT-6 Luna 完全同价(0.10/0.50)、10 万 token 内较前代降价 90%、首次支持可调推理强度与 1M 上下文,并明确把角色锚定在“干杂活的子智能体”。能确认的是发布时间(2026-10-07)、定价与降幅口径、两项新能力及定位表述;必须标清的是,价格与参数事实以官方发布信息为依据、对比对象 GPT-6 Luna 以各官方定价页为准,超 10 万 token 区间计费与可调推理的具体档位仍有待官方补全与第三方实测。

它的真正看点,是 Anthropic 用家族里最便宜的一档,去抢“被高频调用的子智能体”这个入口——当 AI 系统的账单越来越多地由后台子智能体写就,谁拿下单价和上下文,谁就拿下了下一阶段 AI 编排的地基。