中国AI用Token量逆袭美国:一场算力版图的悄然改写
2026年2月,旧金山还在为英伟达的财报欢呼,太平洋西岸的算力洪流却已悄然决堤。
全球最大的AI模型聚合平台OpenRouter的最新数据,像一颗投入资本深水区的石子,激起了连锁反应。2月9日至15日这一周,中国AI模型的周调用量达到4.12万亿Token,历史性地超越了美国模型的2.94万亿Token。这不仅是数字的反超,更是一种象征:在全球开发者用API密钥“投票”的赛场上,中国AI从追随者变成了定义者。
一周后,差距进一步拉大。中国模型的调用量冲高至5.16万亿Token,三周内暴涨127%,而美国模型则下滑至2.7万亿Token。更令硅谷侧目的是,全球调用量排名前五的模型中,中国占据四席——MiniMax的M2.5、月之暗面的Kimi K2.5、智谱的GLM-5以及DeepSeek的V3.2,合计贡献了Top5总调用量的85.7%。
这一刻,华尔街的叙事开始转向。
冰与火之歌:英伟达的“惊雷”与国产算力的“狂飙”
资本市场永远对结构性的变化最为敏感。
就在英伟达发布了一份堪称惊艳的财报后,其股价却意外大跌5.5%,一夜蒸发近2600亿美元(约合人民币1.77万亿元)。市场不再为单纯的业绩增长买单,转而质疑AI资本支出的可持续性。与此同时,A股和港股的算力租赁、云计算、电力板块却掀起了涨停潮。
这“冰火两重天”的背后,是一个核心认知的转变:AI的繁荣,不再简单地等同于英伟达高端芯片的销量。
OpenRouter的用户构成让这次反超更具含金量——该平台美国开发者占比高达47.17%,而中国开发者仅占6.01%。这意味着,中国模型的崛起并非“内循环”的自嗨,而是实打实地赢得了全球开发者的“用脚投票”。知名风投机构a16z的合伙人Martin Casado观察到,如今在硅谷寻求融资的AI初创公司中,其路演核心模型有高达80% 使用的是中国的开源模型。
Token背后的经济学:当“堆卡”时代落幕
中国模型凭什么征服全球开发者?答案藏在两个字里:成本。
在OpenRouter平台上,价格差异触目惊心:MiniMax的M2.5与智谱的GLM-5的输入价格均为0.3美元/百万Token,而海外对标产品Claude Opus4.6的价格高达5美元/百万Token,是中国模型的16.7倍;在输出环节,这一差距更是拉大到22.7倍。
这种“极致性价比”并非源于补贴,而是技术路线的降维打击。
弗若斯特沙利文中国总监李庆指出,以“混合专家(MoE)”架构为代表的技术路线,是中国模型大幅降低推理成本的核心原因。MoE架构通过“按需激活”部分专家网络而非调用全部参数,让推理时的显存占用降低60%,吞吐量提升高达19倍。
这意味着,在传统“模型越强、参数越多、GPU需求越大”的逻辑之外,中国厂商走出了一条新路——用算法效率换取算力解放。摩根大通预测,从2025年到2030年,中国Token消耗量的年复合增长率将达到330%,五年间实现370倍的增长。
从“对话”到“干活”:Agent时代的结构性红利
Token消耗量的指数级攀升,背后是AI使用模式的根本性转变。
AI的角色正从一个提供简单信息的“问答工具”,进化为能够深度参与工作流、处理复杂任务的“生产力工具”。国联民生证券在研报中提出了“Token通胀”的概念:单位时间内、单位用户的Token消耗正在结构性上升。
编程场景首当其冲。OpenRouter与a16z发布的报告显示,编程任务的Token占比从2025年初的11% 飙升至50% 以上。Agent模式下,机器可以持续在后台跑流程:一次编程任务可能经历“写代码→运行→报错→改→再跑”几十个回合,一个活跃会话的上下文很快膨胀到23万Token以上。
在这种负载下,价格差距就是生死线。一家使用OpenClaw的欧洲开发工作室公开了他们的方案:80%的日常推理引擎用Kimi K2.5,20%的硬骨头用Claude。一天的Kimi开销约5到10美元,而如果全量使用Claude,月成本将高达800到1500美元。
涨价背后的新逻辑:价格战结束,需求战开始
有趣的是,在调用量井喷的同时,中国模型开始悄然提价。
2月12日,智谱发布GLM-5的同一天,宣布GLM Coding Plan套餐整体涨价30%起,海外版涨幅更是达到67%-100%。这是国产大模型2026年首次大幅提价。
智谱的回应是:“用户规模与调用量快速提升,公司同步加大算力投入。” 这揭示了一个新逻辑:当Token需求因Agent化而暴涨,涨价本质上是供需的再平衡。
Kimi K2.5的案例更具说服力。该模型支持Agent集群,能根据任务需求调度多达100个“分身”并行工作,将复杂任务处理效率提升3到10倍。据媒体报道,Kimi在发布K2.5后不到一个月的累计收入,已超过其2025年全年的总收入。
结语:算力民主化的中国叙事
从追赶者到领跑者,中国AI模型在OpenRouter平台上的登顶,不仅是一次数据的突破,更标志着一个新时代的开启。
英伟达CEO黄仁勋曾说:“没有算力,就无法生成Token;没有Token,就无法带来收入增长。”当中国模型凭借MoE架构、极致性价比、Agent原生适配,将Token的生成成本降至美国的1/10乃至1/20时,它们不仅赢得了市场份额,更在重塑全球AI的算力民主化进程。
Token是AI时代的“燃料”,而中国厂商正在让这种燃料变得像水电煤一样普惠。当“AI中国团”以集群姿态站上世界舞台,这场由Token驱动的算力革命,才刚刚拉开序幕。
元宇宙与人工智能三十人论坛
因微信公众号整改,没有加“星标⭐️ ”的订阅号有时无法收到消息
1.为防止错过最新资讯,请将元宇宙与人工智能三十人论坛设为星标⭐️
2.点击“赞”和“在看”,提高我们相遇的几率。
3.精彩文章,请点击文末左下角“分享”给好友。
了解更多关注