JOTO
Contact us
← AI 智库
大语言模型

Haiku 5.5发布,Anthropic开始撒钱

2026 年 10 月 8 日

Anthropic发布Haiku 5.5,大幅降价同时升级性能,AI行业价格战再升级。 核心内容: 1. Haiku 5.5的发布背景与降价详情 2. Haiku 5.5的规格与核心功能升级 3. Anthropic同期推出的其他优惠动作

前几天Claude刚增加了简体中文界面,这会儿国庆假期刚过,Anthropic又把Haiku 5.5拿出来了。

这是Haiku系列今年第一次更新,也是继9月22日Opus 5.5、9月28日Sonnet 5.5后,Anthropic在大约半个月里补齐的第三款5.5模型。

Haiku 5.5发布,Anthropic开始撒钱

这次更新,Haiku 5.5把短上下文调用的价格一口气砍了90%。
在10万Token以内,每百万Token输入只要0.1美元,输出0.5美元,缓存读取甚至只要0.01美元。上一代Haiku 4.5对应的价格还是1美元、5美元和0.1美元。
Anthropic自己算下来,大多数典型工作负载的实际成本大约降了75%。

Haiku 5.5发布,Anthropic开始撒钱 配图 2

可以说,在OpenAI把Luna卖到一毛钱之后,Anthropic只用了15天,就把Haiku的输入从1美元压到了一毛钱,直接贴着GPT-6 Luna打。
而且Anthropic今天砍价的还不止Haiku。
几乎同时,它又宣布把Sonnet 5.5的缓存读取价格直接减半,从每百万Token 0.2美元降到0.1美元。
这个数字,同样正好追平GPT-6.1 Sol。

Haiku 5.5发布,Anthropic开始撒钱 配图 3

这还没完。从本周开始,Claude Max和Team用户每个月都会得到一笔Claude Platform额度:Max 5x是100美元,Max 20x是200美元,Team则根据席位计算,最多可以共享500美元。
换句话说,至少按照API额度的面值来看,Anthropic几乎把Max用户每个月交给它的订阅费,又原样返了一份回来。

Haiku 5.5发布,Anthropic开始撒钱 配图 4

 上市在即,Anthropic现在简直是演都不演了。
Haiku 5.5发布,Anthropic开始撒钱 配图 5

   跑腿担当Haiku 5.5

上一代Haiku 4.5推出还是去年10月,这次的Haiku 5.5可是时隔一年的“大更新”,非常有看头。

首先是基础规格。Haiku 4.5只有20万Token上下文,到Haiku 5.5直接拉到了100万Token;最大输出也从6.4万Token翻倍到12.8万Token。

Haiku 5.5发布,Anthropic开始撒钱 配图 6

它还第一次加入了Adaptive Thinking和可调节的effort——简单来说,以前Haiku更像一台只管快速给答案的小模型,而现在,遇到稍微复杂一点的问题,也可以自己决定要不要动动脑子。
同时新增的还有Browser Use,让模型直接操作网页;安全机制也换上了新的分类器拒答机制。
Haiku 5.5发布,Anthropic开始撒钱 配图 7

便宜快速依然是Haiku最重要的卖点。
按照Anthropic的说法,Haiku 5.5是目前Claude家族里标准模式下速度最快的模型,适合那些需要低延迟、大量调用的任务。比如实时聊天、客服、语音助手、信息提取、文件整理,以及越来越常见的浏览器和电脑操作。
官方列出的典型场景里,最值得关注的就是把它作为Opus和Sonnet下面的Subagent——之前只是简单一提,到5.5这一代,Subagent已经被Anthropic明确放进了Haiku的核心用途里。
可以认为,Haiku正在变成Claude家族里专门负责“跑腿”的那个。
比如你让AI做一份报表,负责整体结构和判断的可能还是Opus或者Sonnet,但查一份财报里的具体数字、整理一批资料、点几下网页、分类一堆信息,这些小任务完全可以交给Haiku。

Haiku 5.5发布,Anthropic开始撒钱 配图 8

这个定位和OpenAI刚发布的GPT-6 Luna非常像,同样主打高频、大规模、成本敏感的任务,上下文也同样是约100万Token,最大输出12.8万Token。
关键是,这两款模型的价格也被拉到了几乎相同的位置。
Haiku 5.5在10万Token以内,每百万Token输入0.1美元、输出0.5美元、缓存读取0.01美元;Luna也是0.1美元、0.5美元和0.01美元。
不过,Haiku 5.5一旦Prompt超过10万Token,整档价格会直接涨到短上下文的5倍:输入变成0.5美元、输出2.5美元、缓存读取0.05美元。
Luna那边也不是一成不变,但变得比Haiku温和一点。OpenAI规定,Prompt超过27.2万输入Token后,整次请求都会按长上下文价格计费:输入和缓存价格翻倍,输出涨到1.5倍,也就是0.2美元输入、0.75美元输出、0.02美元缓存读取。
说完了价格,该看看性能了。

Haiku 5.5发布,Anthropic开始撒钱 配图 9

至少从Anthropic公布的测试来看,Haiku 5.5在不少Agent相关任务上压了Luna一头,甚至超了不少。
比如在电脑操作测试OSWorld 2.1上,Haiku 5.5拿到72.4%,GPT-6 Luna只有48.9%;Agent Coding测试Terminal-Bench 4.0里,Haiku是39.2%,Luna只有16.4%;FrontierCode 1.1上,两者分别是46.4%和42.4%。
知识工作也类似。在GDPval-AA v2.1里,Haiku 5.5拿到1620分,Luna是1437分;AA-Briefcase v1.1则是1578分对1336分。
另外,在第三方评测平台Artificial Analysis的Intelligence Index上,Haiku 5.5最高档拿到43分,而GPT-6 Luna最高档是38分。

Haiku 5.5发布,Anthropic开始撒钱 配图 10

不过Luna也不是全面落后。在Artificial Analysis自己的电脑/网页自动化评测AutomationBench-AA上,Luna反而以53.2%明显超过Haiku的35.4%。
现在Haiku 5.5已经进入Claude的Free、Pro、Max、Team和Enterprise套餐,Web、iOS和Android都能用;开发者也可以通过Claude API、Claude Code,以及AWS、Google Cloud和Microsoft Foundry调用。
顺便一提,虽然Anthropic在发布公告里直接把Haiku 5.5称为目前最快的Claude模型,但在脚注里又很老实地补了一句:这是指各模型都跑在标准速度下的情况。如果打开快速模式,Haiku 5.5还是跑不过Opus。
Haiku 5.5发布,Anthropic开始撒钱 配图 11
拿最便宜的“跑腿模型”和最贵的加速档比,多少有点不讲武德。
Haiku 5.5发布,Anthropic开始撒钱 配图 12

 统统大降价 

然而,和另外两个“撒币”行为相比,Haiku 5.5简直就像开胃小菜。
Anthropic同时正式下调了Sonnet 5.5的缓存读取价格,从每百万Token 0.2美元降到0.1美元,目前没有注明任何限时条件。Haiku 5.5公告里的最新价目表已经把Sonnet 5.5的价格改了。
这看起来只是价目表里一个不起眼的小数字,但对Agent来说,影响可能比想象中大得多。
Anthropic自己估算,因为Agent在长时间运行时会反复读取系统提示词、工具定义和历史上下文,缓存读取往往会消耗很大一部分Token,所以这一刀下去,大多数Agent任务跑Sonnet 5.5的总体成本还能再降大约20%。
在这条降价消息下面,开发者几乎是一片叫好。

Haiku 5.5发布,Anthropic开始撒钱 配图 13
Haiku 5.5发布,Anthropic开始撒钱 配图 14
Haiku 5.5发布,Anthropic开始撒钱 配图 15
Haiku 5.5发布,Anthropic开始撒钱 配图 16

可以说,Anthropic直接从两头一起给Agent压价:一边把跑腿的成本压下去,另一边把主Agent长期工作的成本也压下去了。
更离谱的还在后面:
从这周开始,Claude Max和Team套餐会额外附赠一笔Claude Platform API额度:Max 5x每月100美元,Max 20x每月200美元;Team则按照席位计算,所有额度汇总到一起,每月最多500美元。

Haiku 5.5发布,Anthropic开始撒钱 配图 17

也就是说,从API标价来看,一个Max 20x用户每个月交200美元订阅费,Anthropic现在又额外给他发200美元API额度。
而且这笔钱和原本Claude、Claude Code、Cowork里的订阅用量是分开的,不会占掉原来的额度。虽然没用完会过期,但每个计费周期都会重新发。
更重要的是,官方表示这些额度可以用于Claude API、Batch API、Claude Console Playground、Claude Managed Agents和Claude Agent SDK,而且任何当前可用的Claude模型都能花。
这意味着,只要第三方Harness最终调用的是你这个Claude Console组织里的API Key,同样可以消耗这笔余额。
你可以自己写一个Agent,可以用Agent SDK,可以让别人的Harness调用Claude。只要最后用的是Anthropic的Token,它甚至愿意先替你出一部分钱。
(账号仍然完好的)Max用户简直要笑疯了好吗?

Haiku 5.5发布,Anthropic开始撒钱 配图 18
Haiku 5.5发布,Anthropic开始撒钱 配图 19

不过,这也不是完全没有限制。
API额度不能拿来抵Claude Code里的交互式使用,也不能抵Claude、Claude Code和Cowork超额之后的Extra Usage;Bedrock、Google Cloud Vertex AI和Microsoft Foundry里的Claude调用也不算,新Max或Team用户还要先订阅满7天才能领取。
但这些限制并不影响它的方向,Anthropic几乎要把“快来订阅”顶在脑门上。
说来有趣,就在前几天,Claude社区里还有人在认真讨论:Anthropic需要一款更便宜的模型。

Haiku 5.5发布,Anthropic开始撒钱 配图 20

有人专门拿Haiku 4.5和刚发布的GPT-6 Luna算了一遍账。前者每百万Token输入1美元、输出5美元,后者只有0.1美元和0.5美元,整整差了十倍。在Agent会大量调用worker模型的情况下,这个差距足以直接决定开发者的选择。
有人甚至直接说,虽然他们公司喜欢Claude,但真正干活的主力模型还是Luna,原因就是API账单差太多。
结果,社区前脚还在说Claude太贵,Anthropic后脚就像把评论区打印出来了一样,直接开始大降价。
把今天这三件事放在一起看,Haiku负责让Subagent便宜,Sonnet负责让长时间运行的Agent便宜,API Credit则直接给Max和Team订阅再塞一笔开发预算。
为了推动Claude进入更多Agent和Harness、再冲一下销量,Anthropic也开始搞“百亿补贴”了。
Haiku 5.5发布,Anthropic开始撒钱 配图 21

 上市前,再冲一把  

这一连串的动作,很难不和Anthropic即将上市的消息联系在一起。简直就像商场开业前先发点优惠券来吸吸流量——如果它还需要更多流量的话。

路透社在Haiku 5.5发布之后直接把这次更新放在了IPO语境里:Anthropic正在为计划中的上市继续扩充Claude产品线。Haiku 5.5也是Claude 5.5家族在一个月内补齐的第三款模型。
此前报道显示,Anthropic原本最早计划在10月中旬启动IPO营销,但最新安排可能推迟到11月美国中期选举之后。如果计划不再继续后移,Anthropic最快也就是接下来这一两个月正式冲刺上市。

Haiku 5.5发布,Anthropic开始撒钱 配图 22

而且Anthropic现在其实很需要在上市前继续证明自己的增长。
路透社此前披露,Anthropic的年化收入已经从2025年底大约90亿美元,一路冲到今年7月底超过650亿美元;公司内部还预计,2028年收入可能达到1900亿至2000亿美元。
这意味着,它现在最需要证明的,不只是Claude够不够强,还有Claude能不能继续卖得更多。
尤其是,OpenAI还在持续施压。
路透社此前援引Ramp数据称,GPT-6 Astra已经拿到其追踪企业AI支出的约13%,Claude Fable约为8%;OpenRouter上,OpenAI模型的用户支出也一度超过Anthropic,这是两年半以来第一次。消息人士称,这已经让一些潜在IPO投资者重新评估Anthropic此前在企业AI市场的领先位置。
现在看来,这篇报道标题中提到的“新模型”,应该指的就是5.5这一套组合。

Haiku 5.5发布,Anthropic开始撒钱 配图 23

某种意义上,Anthropic这次几刀,几乎都是冲OpenAI去的——OpenAI把价格往下打到哪里,Anthropic就跟到哪里。
Haiku 5.5把短上下文输入价格从1美元直接压到0.1美元,正好和GPT-6 Luna同价;Sonnet 5.5的缓存读取从0.2美元砍到0.1美元,又正好追平GPT-6.1 Sol。
说到底,上市前最怕的就是增长不好看。
如果模型价格更低,可以换来更多API调用;如果Max订阅更划算,可以换来更多付费用户;如果开发者更愿意把Claude塞进自己的Agent和Harness里,也就意味着未来可能有更多稳定的Token消费。
今天这些降价和补贴花出去的钱,可以先算成获客成本。只要它能在上市前把用户、收入和调用量再往上冲一冲,这笔账就不难解释。

立即咨询 JOTO

JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询

想把这些做法用到你的业务里?

留下你的场景和痛点,我们帮你判断从哪一步开始。

联系我们
Contact Us

Start your enterprise AI rollout

Tell us your industry, team, and current pain points. We'll get back to you within one business day to help you decide what to tackle first, what data to prepare, and which platform fits.

WeChat
Scan to add us for a 1:1 chat
JOTO WeChat consultation QR code

Tell us what you need

Once we receive your details, we'll be in touch within one business day.