10 月 7 日,Anthropic 正式推出 Claude Haiku 5.5,官方给它的定语相当密集——迄今最快、成本最低、能力最强的 Haiku。对普通用户来说这可能只是一次例行升级,但如果你平时靠 API 跑智能体、做自动化,这波更新基本等于「账单直接砍半再砍半」。按官方口径,Haiku 5.5 的平均运行成本较上一代 Haiku 4.5 下降约 75%,10 万 token 以内的常规请求价格更是直降 90%,这个力度在 Anthropic 历代模型更新里非常罕见。
更有意思的是,Anthropic 这次是「组团降价」:Haiku 5.5 大幅下调单价的同时,Sonnet 5.5 的缓存读取价格腰斩,订阅用户还白送每月 API 积分。结合同一天 OpenAI 发布 GPT-6 的时间点,小模型市场的价格战已经彻底白热化了。
价格直接砍到脚踝:10 万 token 以内降 90%
先看最关键的账本。Haiku 5.5 对提示词不超过 10 万 token 的请求,输入价格为每百万 token $0.10,输出为每百万 token $0.50,较前代下降 90%。Anthropic 透露,上代 Haiku 约 90% 的调用量都落在这个区间内,也就是说绝大多数开发者的实际支出会直接掉一个数量级。
超过 10 万 token 的长上下文请求,价格降 50%,输入 $0.50、输出 $2.50 每百万 token。需要提醒的是,Haiku 5.5 换了新分词器,同样一段文本会多用约 25% 的 token,但把单价降幅和用量增幅放在一起算,综合运行成本仍然省下约 75%——这也是官方「平均降 75%」说法的由来。缓存和批处理还能再叠加最高 50% 的折扣,实际跑起来弹性很大。
性能没有摆烂:OSWorld 从 15.7% 跳到 72.4%
便宜不等于弱,这次的成绩单反而有点吓人。计算机操作基准 OSWorld 2.1 离线子集上,Haiku 5.5 拿到 72.4%,上一代只有 15.7%,直接翻了四倍多,甚至压过 GPT-6 Luna 的 48.9%。智能体编码 Terminal-Bench 4.0 从上代的 0% 提升到 39.2%,FrontierCode 1.1 拿到 46.4%。知识工作测试 GDPval-AA v2.1 拿下 1620 分,AA-Briefcase v1.1 拿下 1578 分,多学科推理 Humanity's Last Exam 无工具 45.9%、带工具 57.4%。
实际用下来是什么体感?早期客户 Asana 反馈,任务完成延迟降低超过 30%,单个智能体回合的推理速度最快提升到原来的 2.5 倍。对要跑成百上千次调用的自动化流程来说,速度和成本同时改善,才是真正省钱的地方。
首款支持推理强度调节的 Haiku,定位子智能体
Haiku 5.5 是 Haiku 家族第一个带可调推理强度(effort setting)的模型,从 Low 到 Max 五档,用户可以自己决定这单生意是省钱优先还是聪明优先。官方放出的曲线上,高档位下它的 OSWorld 和 GDPval 成绩还能继续往上爬,弹性比想象中大。
定位上,Anthropic 把它描述成 Opus 5.5 和 Sonnet 5.5 的「子智能体」——大模型负责拆解和决策,Haiku 5.5 负责高频杂活:摘要、压缩、数据库查询、分类、浏览器操作这类重复劳动。模型 ID 是 claude-haiku-5-5,已在 Anthropic 平台、AWS、Google Cloud 和 Azure 同步上线,Python 和 TypeScript SDK 也加入了计算机操作与浏览器操作的测试版支持。
组团让利:Sonnet 缓存价格腰斩,订阅白送 API 积分
这次更新不只动了 Haiku。Sonnet 5.5 的缓存读取价格从每百万 token $0.20 直接砍半到 $0.10,官方估算多数智能体任务的运行成本能再降约 20%。跑过智能体的人都知道,缓存读取在长会话里是大头,这个降价对存量用户是纯送钱。
订阅侧也有动作:Claude Max 5x 用户每月送 $100 API 积分,Max 20x 用户每月 $200,Team 订阅团队最高每月 $500 共享额度。用官方的话说,这是为了鼓励大家在 Claude 平台上搭自己的智能体和应用——一边降价一边发钱,抢开发者的意图相当明显。
追平 GPT-6 Luna,但国产小模型更狠
把视线拉回行业,Haiku 5.5 的定价已经基本追平 OpenAI 同日推出的 GPT-6 Luna,两家小模型的单价第一次站在同一条线上。不过放到全球市场看,价格战的下限还在别处——国产小模型明显更便宜,比如 Qwen3.7 Flash 输入价格只要 $0.03 每百万 token,智谱 GLM-5.3-Flash 在知识测试榜上还拿到过 1647 分,比 Haiku 5.5 的 1620 分还高一点。
对开发者来说,这波更新的实用结论很简单:如果你在用 Claude 生态做智能体,Haiku 5.5 值得第一时间切换,成本和速度都是肉眼可见的改善;如果你对价格极度敏感、且不依赖 Claude 生态,国产小模型依然是性价比首选。对普通用户而言,短期内最直观的变化可能是——各家 AI 产品的订阅价格有望继续往下走,等等党这次真的赢了。
相关阅读:


