刚过去的2月,全球AI圈的“风向标”OpenRouter甩出一组数据,直接改写了行业格局——中国AI模型的Token调用量,第一次超过美国了!

中国AI调用量首次超过美国

作为全球最大的AI模型API聚合平台,OpenRouter的用户里47%是美国开发者,中国仅占6%,这份“海外视角”的数据比任何“自夸”都真实。2月9日-15日那周,中国模型周调用量冲至4.12万亿Token,一举超过美国的2.94万亿;仅一周后,这个数字再涨至5.16万亿,三周内猛增127%,把领先优势越拉越大。

中国AI调用量首次超过美国

更炸的是全球榜单的“中国浓度”:调用量前五的模型里,四款都来自中国厂商——MiniMax刚上线的M2.5,不到一周就登顶周榜,单款贡献了1.44万亿Token增量;月之暗面的Kimi K2.5靠多模态和100个“Agent分身”,上线不到一个月收入超去年全年;智谱GLM-5用200K长上下文搞定复杂任务,上线次周调用量就破0.8万亿;还有DeepSeek V3.2,早就是榜单“常客”。连阿里千问这种“低调玩家”,全系列总调用量都排到了全球第二——不是某一款模型“独挑大梁”,是一群中国厂商组成“AI中国团”一起冲上去的。上海财大胡延平教授说,这种“集群优势”比寡头垄断更有后劲,“多家头部企业形成技术群落,才能在全球竞争中扛住压力”。

中国AI调用量首次超过美国

海外开发者为啥偏爱中国模型?答案就俩字:“划算”。OpenRouter上,MiniMax M2.5的输入成本才0.3美元/百万Token,而美国Claude Opus4.6要5美元,差了16倍;输出成本更夸张,M2.5是1.1美元,Claude直接飙到25美元——相当于做同样的事,中国模型的成本连美国的1/10都不到。这不是“低价竞争”,是技术硬实力撑起来的:比如MoE架构把大模型拆成“专家网络”,按需激活减少算力浪费;阿里“通义-云-芯”的垂直整合,从算法到芯片全链优化,把每一分算力都用在了刀刃上。

中国AI调用量首次超过美国

更关键的是,AI早不是“聊天工具”了。以前用户用AI问“今天吃什么”,现在是用它写代码、改文档、跑测试——这些“生产力任务”天然费Token,但中国模型不仅便宜,还能搞定复杂活:Kimi能同时调度100个Agent分身,GLM-5能记住200K字的长内容,这不就是开发者最想要的“效率工具”吗?连硅谷初创公司都在“用脚投票”——a16z的合伙人说,现在硅谷找融资的AI公司,80%的核心模型都用中国开源的。

中国AI调用量首次超过美国

其实最本质的变化,是“Token”的意义——以前它是互联网的“流量”,现在变成了AI时代的“燃料”。就像英伟达黄仁勋说的,“没有Token就没有收入”,当AI从“玩个新鲜”变成“靠它吃饭”,谁能提供更划算、更高效的“燃料”,谁就攥住了未来的主动权。2月的这场“反超”,不是中国AI的“终点”,是向全球市场递出的一张“入场券”——以前我们追着别人跑,现在别人跟着我们选。

中国AI调用量首次超过美国

下一个阶段,AI拼的不是“谁更贵”,是“谁能帮开发者赚更多钱”。而中国AI,已经站在了起跑线上。