DeepSeek降价最高60%,砍得最狠的偏偏是最便宜一档
2分钱:60%究竟降在哪一档
2026年9月9日,DeepSeek在其官方开放平台宣布下调Flash系列模型API定价,新价格自北京时间9月10日12:00起生效。界面新闻、财联社等媒体报道给出的调整后价格为:空闲时段输入(缓存命中)0.02元、输入(缓存未命中)1元、输出4元,高峰时段价格为此前的两倍关系不变。
媒体只给了新价,没有列原价。但原价并不需要猜测——DeepSeek官方API文档的定价页至今仍挂着调整前的三档数字:deepseek-v4-flash输入(缓存命中)0.05元、输入(缓存未命中)1.5元、输出4.5元,单位均为元/百万tokens。截至9月9日发稿,该页面尚未刷新,因为新价要到次日中午才生效。
把两组数字放在一起,报道中的三个降幅全部可以精确验算:0.05元降到0.02元,降幅60%;1.5元降到1元,降幅33.3%;4.5元降到4元,降幅11.1%。三项小数位完全吻合,说明媒体报道的百分比正是以官方定价页这三档为基数计算的,计费单位也由此确认为元/百万tokens,而非部分转载文章中含糊表述的"元/千tokens"。
三档三个降幅,本身就是策略
同一份公告里出现60%、33%、11%三个跨度极大的降幅,这不是定价团队随手取整的结果。把三档还原成成本结构,顺序会倒过来。
缓存命中输入是四类计费项里最特殊的一档:命中的内容此前已被计算并缓存在服务端,调用时直接读取,几乎不再产生额外的推理算力开销。DeepSeek把这一档从0.05元砍到0.02元,降幅最大,对自身推理成本的冲击却最小。输出价则相反,每一个字都要真实占用算力,4.5元降到4元只让出11%,是三项中最保守的一步。缓存未命中的输入介于两者之间,需要完整过一遍前向计算,因此降幅33%。
于是这次调价的真实形状浮现出来:降幅与边际成本高度负相关。DeepSeek削减的是报价单上最便宜、也最不影响其成本线的那一行,同时守住了真正贵的那一行。对一个按token计费的API业务而言,这是一次伤害极低的降价——名义降幅足够吸引眼球,实际毛利让渡幅度远小于60%。
峰谷框架也没有被推翻。官方文档明确写着"空闲时段价格为高峰时段价格的一半",并把高峰时段定义为北京时间周一至周五9:00—12:00、14:00—18:00。9月的动作是在峰谷结构内部下调空闲价档位,等于继续用价格引导用户把工作负载推向夜间与非工作时段,这一导向与8月公告的初衷一致。
8月那次被读成"涨价"的动作,官方原文没有"涨"字
市场分析把本轮动作解读为对8月定价调整的回摆。回溯官方记录:2026年8月13日,DeepSeek在发布V4-Pro正式版的同时公告"API定价调整",称"随着DeepSeek V4全系列模型正式版上线,我们将对API价格进行更新调整。为了更加合理地调配资源,我们将采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间",新价格自8月17日0时生效。
需要留意的是官方措辞:公告通篇讲的是"调配资源"与"峰谷定价",没有出现涨价表述。但从用户账单看,效果是分层的——原本只需支付单一价格的用户,其日间调用成本在8月17日后被抬到空闲价的两倍。媒体所称"8月中大幅涨价",是对这一结构变化的市场解读,而非DeepSeek的自我表述。二者不宜混同。
至于8月17日之前deepseek-v4-flash的单一价格具体是多少,本次未能取得官方原始口径,公开存档渠道不可访问,因此"一个月内先涨后降"中的涨幅数值无法量化核验,本文不作数字引用。
同一天,竞品的五折促销到期
真正把这次降价放进竞争语境里的,是一条时间线索。智谱Z.ai官方定价页显示,GLM-5.3-Flash正处于五折促销中:输入0.075美元、缓存输入0.015美元、输出0.25美元(每百万tokens),页面同时标注原价为0.15/0.03/0.50美元,并注明"促销于2026年9月9日24:00(UTC+8)结束"。
也就是说,DeepSeek发布公告的当天夜里,竞品Flash档的限时折扣到期,9月10日起GLM-5.3-Flash按原价执行。两个公开时间点前后相差不到一天,这解释了为什么市场对本次降价的敏感度高于一般的价格微调。
按1美元折合7元人民币粗略折算(本估算非官方口径),智谱促销结束后的GLM-5.3-Flash约为输入1.05元、缓存输入0.11元、输出3.5元每百万tokens。对照DeepSeek降价后的0.05→0.02元、1.5→1元、4.5→4元,可以看到:DeepSeek在缓存命中输入这一档明显更便宜,输出价则仍高于智谱。降幅最大的档位,恰好是它本来就最具优势、且成本最低的档位。
关于"流量被中转平台与竞品分流迫使DeepSeek回摆"的判断,媒体报道一律标注为"市场分析认为",属于外部推断。DeepSeek未在公告中说明调价原因,截至发稿也未见公司人士公开回应,本文将其保留为一种解释假说,而非已确认的动机。
12:00生效,未必是掐点狙击
把生效时间定在9月10日12:00,很容易被读成对竞品促销到期的精准卡位。但官方峰谷规则给出了一个更朴素的解释:9月10日为星期四,12:00正是当日高峰时段(9:00—12:00)结束、空闲时段开始的切换点。在一个"闲时价为峰时价一半"的双轨计费体系里,于时段边界切价,可以让所有用户的账单在同一时刻干净地翻到新版本,避免高峰时段中途改价的计费争议。
因此,这次动作与竞品节点在时间上确实重叠,但重叠本身不足以证明因果关系。更值得看的判断是:DeepSeek选择在竞品质价窗口打开的当口下调自己最便宜的一档,用最小的成本代价换取了最大的报价感知——这是"低伤害、高感知"的定价打法,而不是全面价格战。
市场层面的反应同样需要克制解读。界面新闻报道,9月9日盘初中证人工智能主题指数(930713)一度涨超1%后回落,午间收盘跌0.53%,成分股中中航成飞涨5.32%、光迅科技涨2.96%、中际旭创涨0.93%。该指数权重覆盖算力、光模块等环节,其涨跌受多因素影响,把它与一次API调价建立直接因果缺乏证据,此处仅作为当日市场表现记录。
接下来值得盯的三件事
第一,9月10日12:00后官方定价页是否如期刷新为0.02/1/4元,以及高峰时段是否维持两倍关系——这决定本次降幅是全部落在空闲档,还是同步压缩了高峰档。第二,deepseek-v4-pro(现价空闲0.15/4.5/13.5元)与视觉实验模型deepseek-v4-flash-vision-exp是否跟随下调,若高价档按兵不动,则"只砍便宜档"的判断成立。第三,媒体提及的V4.1 Flash内测进度。需要注明的是,DeepSeek官方文档与更新日志中目前只有V4系列(V4-Flash-0731、V4-Pro-0813),并无V4.1条目,该型号说法暂属媒体表述,尚未获官方证实。
对开发者而言,可验证的现实收益集中在高频复用长上下文的应用形态:Agent框架、代码补全、多轮长文档问答,这类场景缓存命中率天然更高,0.02元/百万tokens的读取价格几乎抹平了上下文重复调用的成本。而对输出长度不可控的内容生成场景,11%的输出降幅带来的变化相当有限。同一个"最高降60%",两类应用的实际成本曲线不会同步下降。


