中国AI大模型连赢23周,匿名太空兔为何一夜登顶?
上周(9月28日至10月4日),全球AI大模型在OpenRouter平台上的总调用量达到166万亿Token,中国上榜模型的周调用量为57.46万亿Token,美国的同期数据为16.2万亿Token。中国连续第23周超越美国,稳居全球首位。
更引人注目的是一组排名数据:在全球调用量前五的模型中,有四款来自中国。其中DeepSeek V4.1 Flash以25.6万亿Token位居第二,智谱GLM 5.3 Flash排第三,小米MiMo-V2.6-Flash和腾讯Hy4 preview分列第四、第五。但真正抢镜的是一个从未露面的名字——Space Bunny Alpha(太空兔),它以38.7万亿Token、环比增长179%的速度登顶单模型榜首。
一个有趣的悖论摆在面前。过去三年,全球科技圈的主流叙事是“美国技术在引领,中国在追赶”。当ChatGPT、Claude等美国模型频繁刷新能力天花板时,国内大模型更多在开源社区和开发者工具中默默迭代。但现在,一个不同维度的比较出现了。这不是按Benchmark分数排的座次,而是按真实调用量划分的战场。在这场反映实际使用规模的竞赛中,中国不仅追平了差距,而且拉开了三倍以上的距离。
Flash模型潮涌与开发者的成本账
Space Bunny Alpha并非孤立现象。它的爆火背后是全球开发者对“Flash”系列模型的集体转向。
OpenRouter平台的数据显示,谷歌在过去六周内连续三次更新其Flash系列;国内厂商同样动作密集——DeepSeek V4.1 Flash、智谱GLM 5.3 Flash和小米MiMo-V2.6-Flash相继加入战团。多家厂商的发力方向正在趋同:增强编程辅助、Agent(智能体)和多模态能力,同时把响应速度和成本控制放在更显眼的位置。
这种趋势的背后是明确的商业逻辑。对于大量日常任务而言——代码补全、文本生成、数据分析、客服问答——开发者不再追求“最聪明”的模型,而是需要“最快且最便宜”的模型。Flash系列定位就是如此:通过量化压缩和架构优化,牺牲一部分推理精度换取数量级的成本下降。
一家中型SaaS公司的CTO曾对媒体透露,将内部某个高频文本处理工作流从标准版模型切换到Flash版本后,API费用下降了约七成。虽然回答质量有轻微损失,但在大多数业务场景下,这个损耗完全可以接受。
DeepSeek V4 Flash预览版(V4 Flash 0423)此前位列第九,本周直接跌出榜单。这说明市场在快速分化——旧版Flash要么被升级版替代,要么被更便宜的对手挤走。技术迭代速度之快,意味着今天的领先优势可能下周就不复存在。
“太空兔”是谁?
Space Bunny Alpha于9月23日上线OpenRouter,仅一周便以近四倍于第二名DeepSeek V4.1 Flash的量级登顶,令人咋舌。
官方资料描述它为一个主打快速推理和编程的模型,拥有100万Token上下文窗口,支持文本、图像和视频输入,并提供可调节的推理强度与工具调用能力。这些参数听起来并不惊人——许多主流模型已经标配百万级上下文。但它的数据表现完全超出预期。
第三方tokenizer(分词器)指纹测试给出了一条线索。测试人员用50个标准字符串对Space Bunny Alpha进行token计数比对,结果与MiniMax系列的输出完全一致。这一发现迅速在技术社区发酵,推测该模型大概率来自国内人工智能公司MiniMax。不过,截至发稿,Space Bunny的身份尚未得到任何官方确认,发布方也选择了彻底的匿名策略。
为什么选择匿名?一种可能的解释是品牌策略。如果Space Bunny代表MiniMax最新的技术路线,直接在OpenRouter上以独立身份亮相可以绕过既有品牌包袱,让性能本身说话。另一种可能是团队流动性问题——部分AI研发团队存在核心成员变动频繁的行业常态,匿名上线或许是为了规避声誉风险。无论哪种情况,都不影响它在平台上创造的商业事实。
规模优势不等于技术全面领先
连续23周的领先是一个值得观察的信号,但它传递的信息需要仔细辨析。
OpenRouter本质上是AI模型API的分发与聚合平台。在这个平台上,中国模型的占比更高,原因之一是该平台在中国开发者群体中的渗透率较高。而OpenRouter用户以程序员和初创企业为主,他们正是Flash模型最密集的采购方。因此,这里的“中国第一”首先反映的是特定平台上的特定用户结构,而非全行业、全场景的综合对比。
更重要的是,OpenRouter的统计数据不涉及商用部署和企业私有化落地。在企业端,美国模型如GPT-4o、Claude依然占据高端商务应用场景的主导地位;而在消费端,抖音、微信等平台内嵌的AI助手多数使用国产底座模型,这部分流量不会出现在OpenRouter的统计里。所以这是一个“偏科”的比较——在一个侧重开发者生态和国际化的平台上,中国模型确实展现了强劲的规模和性价比优势,但这不代表在基础科研、前沿探索或某些垂直领域的全部领先地位。
此外,OpenRouter本身也在不断调整规则。比如它对模型归属的分类依据尚未公开明确——是按注册地、团队国籍还是服务器位置来划分国家标签,这会影响后续每周数据的可比性。
看什么指标判断下一阶段走势
未来几个月,以下三个信号值得关注:
Flash系列的市场份额演变。 当更多模型加入“快且便宜”的竞争赛道,价格战是否会重蹈早期云计算行业的覆辙?哪些厂商能在成本和性能之间找到最优解并持续下去,谁会被淘汰出局,这将决定行业格局是否最终收敛。
Space Bunny Alpha能否维持高位。 上线一周即达到38.7万亿Token的峰值之后,后续数据走向如何?如果它能站稳头部位置,说明“性价比优先”不是短暂热潮而是结构性转变;如果迅速回落,则意味着品牌效应和用户粘性仍然不可替代。
中国模型出海进展。 除了OpenRouter这类平台渠道,国产大模型能否直接进入欧美企业的采购清单?目前来看,语言壁垒和数据合规仍是主要障碍,但若能在特定细分领域(如电商文案、跨境电商客服)建立差异化优势,仍有突围空间。
对中国AI产业而言,当前的阶段特征已经从“能不能做”转入“做得好不好、卖得贵不贵”。在这个新战场上,规模化调用量的领先既是底气,也需要清醒认知边界在哪里。


