BT财经

境内金融信息服务备案编号:

【京金信备(2021)5号】

2026年10月10日

注册 / 登录

Claude Haiku 5.5降价90%,大模型价格战重燃

$0.10。这是 Claude Haiku 5.5 在短 Prompt 任务上的每百万 Token 输入价格。

对于习惯了按昂贵计价单位核算 API 成本的开发者而言,这个数字极具冲击力:它比上一代产品(Haiku 4.5)低了整整 90%,更是大幅低于目前市场主流竞品的平均水平。配合长 Prompt 任务 50% 的降价幅度,Anthropic 此次不仅发布了新模型,更向行业宣告了一个残酷的现实——大模型的推理成本已经被压缩到了一个全新的临界点之下。

这不是简单的促销打折,而是一次底层的商业逻辑重构。当大模型的价格逼近“公用事业”级别的低廉,整个 AI 应用层(尤其是那些长期受困于高额算力成本的 ToC 端 Agent 厂商)即将迎来前所未有的利润释放空间。

打破“越智能越贵”的魔咒

在过去几年里,大模型的发展始终遵循着“军备竞赛”的逻辑:更强的能力往往意味着更多的参数、更高的训练成本和更昂贵的 API 售价。然而,Claude Haiku 5.5 的出现试图打破这一魔咒。

在技术规格上,Haiku 5.5 引入了一个名为“Adjustable Effort Setting”(可变努力设置)的关键功能。这使得用户能够在速度与智能之间进行手动权衡。对于大量日常高频任务——如快速文档摘要、数据库查询分类、或是浏览器自动化操作——用户不再需要为顶级的推理能力支付溢价,只需调用最低的“努力”层级即可满足需求。

此外,该模型更新了底层 tokenizer,使其架构全面对齐更强大的 Sonnet 5.5 和 Opus 5.5 系列。虽然新的 token 编码方式导致完成同一任务的 Token 消耗量略有微增,但在绝对成本下降 90% 的大背景下,这一微小的摩擦成本几乎可以忽略不计。

性能数据同样令人瞩目。在与 Haiku 4.5 的直接对决中,Haiku 5.5 取得了跨越式提升:在计算机操作测试 OSWorld 中,得分从 15.7% 飙升至 72.4%;在无工具推理测试 Humanity’s Last Exam 中,得分从 10.2% 跃升至 45.9%。这意味着,曾经只适用于简单闲聊的“小模型”,现在已经具备了承担复杂工作流子任务的能力。

$0.10 时代的账本重构

要理解这次降价的破坏力,我们需要算一笔详细的账。

根据 Anthropic 的公告,构成历史 90% 流量的短 Prompt 请求(≤10万 Token)迎来了断崖式的降价:输入端跌至 $0.10/百万 Token,输出端为 $0.50/百万 Token。即便是处理复杂的长上下文任务(>10万 Token),其价格也下调了半壁江山。综合考量新 tokenizer 带来的微小损耗,官方核算出的整体平均运行成本较上一代下降了约 75%。

这省下来的钱,最终会流向哪里?答案是下游的 AI 应用开发者。

长期以来,ToC 端的 AI 自动化工具(如生活助理 Agent、实时多语言客服、代码辅助编写工具)一直面临着一道难以逾越的盈利门槛:单次 API 调用的成本经常占据最终售价的很大比例。当基础算力成本如今天这般崩塌,这些应用的毛利率将迎来结构性修复。此前因成本过高而搁置的高并发场景,现在终于可以在财务模型上跑通闭环。

与此同时,Anthropic 明确将 Haiku 5.5 定位为 Agentic 工作流中的“子代理(Subagent)”。建议其在执行代码提取或简单逻辑编写时,配合更昂贵的 Sonnet/Opus 共同工作。这种“大小搭配”的混合路由策略将进一步放大降本效应——用最便宜的模型去吞噬 90% 的重复性劳动,只把高昂的算力留给真正的难题。

AI 基础设施化:从奢侈品到水电煤

从产业视角来看,Anthropic 此举实质上是在推动大模型向“基础设施化”转型。

当一个产品的边际成本趋近于零时,它就完成了从“商品”到“基础设施”的身份转换。在这个阶段,竞争的核心不再是“谁更聪明”,而是“谁的服务更稳定、覆盖更广、且价格更低廉”。Haiku 5.5 的 $0.10 定价,正是将价格拉回了基础设施的阈值。

这对行业巨头 OpenAI 形成了直接的施压。虽然 OpenAI 并未随 Haiku 5.5 同步更新其 O1 或 GPT-4o 系列的公开报价表,但在开源模型(如 Google 的 Gemini Flash 系列和各类开源微调模型)的夹击下,维持高昂的利润率已变得越来越困难。一旦下游应用层的利润被挤压殆尽,OpenAI 要么被迫跟进降价,不得不牺牲短期财报表现以保住市场份额;要么眼睁睁看着那些成本敏感型的开发者倒向更具性价比的供应商。

这种“底层推力”不仅改变了模型厂商的博弈格局,更可能引发 AI 产业链价值的重新分配。过去,价值集中在拥有顶级算法和算力的模型层;而在未来,随着算力成为一种廉价的公共品,价值链将不可避免地向能够深刻理解场景、掌握流量入口的应用层迁移。

正如 Anthropic 在公告中所暗示的那样,我们或许正站在一个新时代的起点:大模型不再是少数精英企业才能用得起的“魔法黑盒”,而是成为了像云计算和电力一样触手可及的基础设施。

对于那些正在等待风口到来的 AI 创业者而言,$0.10 时代已经到来。他们现在需要的,不再是苦寻更便宜的算力,而是去抢占那些尚未被数字化的真实场景。

后续观察指标

1。 OpenAI 及 Google 的定价响应速度:预计在未来 1-3 个月内,主要竞品是否会在特定层级推出对标甚至低于 $0.10/百万 Token 的新定价方案。 2。 头部 Agent 平台的毛利率变化:重点关注如 Zapier、Notion AI 或独立 ToC 智能体开发商在下个季度的财报电话会议中,是否将“API 成本骤降”列为改善毛利率的核心驱动因素。 3。 混合路由架构的普及率:观察大型 SaaS 企业(如 Salesforce, Slack)是否在内部技术栈中大规模引入“廉价小模型预处理 + 昂贵大模型决策”的动态路由策略。 4。 边缘侧本地算力需求变动:鉴于云端推理成本极低,传统依赖本地 NPU 处理轻量化任务的硬件厂商(如手机芯片、PC 端侧 AI 芯片)是否面临需求替代风险。



版权声明:本文版权归BT财经所有,未经允许任何单位或个人不得转载,复制或以任何其他方式使用本文全部或部分,侵权必究。
帮助中心
联系我们
联系我们

 

商务合作:

 

公司地址

北京市丰台区汉威国际广场一区一号楼629

 

 

商务合作

周先生

Tel: +86-17743514315

Email: info@btimes.com.cn

官方微信公众号

北京领讯时代信息技术有限公司 | Copyright ©️ 2026 财经时报 版权所有 京ICP备19043396号-7

京公网安备 11010602007380号 | 境内金融信息服务备案编号:京金信备(2021)5号

网信算备110106674807801230011号


声明:未经授权,不得复制、转载或以其他方式使用本网站的内容。BT财经尽最大努力确保数据准确,但不保证数据绝对正确。