美国AI对华领先优势已消失?斯坦福423页AI报告划重点
智东西4月14日消息,昨日晚间,美国斯坦福大学以人为本AI研究院(HAI)发布长达423页的《AI指数报告2026》,报告提到全球顶尖AI模型的性能格局,正呈现中美交替领先的态势。
多家外媒在分析报告时提到,在AI领域,中国与美国的差距几乎已经消失。
2025年整体来看,支撑AI发展的资源投入仍在持续增长,但其中有两大风险。
首先,重磅模型发布数量较上年有所减少,前沿AI系统愈发集中在极少数机构手中,但模型的训练代码、数据集规模、参数量等核心信息开源大幅减少。
其次,自2022年以来这些模型背后的算力需求每年增长约3.3倍,但几乎所有算力都依赖中国台湾的台积电,导致全球硬件供应链很脆弱。
1、产业界主导90%以上顶尖AI模型,但最强模型透明度变低
2025年,超过90%的标杆AI模型由企业打造,报告显示,2025年美国共发布50个标杆AI模型,位居全球第一;中国发布30个,位列第二;韩国发布5个,加拿大、法国、中国香港、英国各发布1个。
在产业界,2025年全球顶尖模型贡献方为OpenAI(19个)、谷歌(12个)、阿里巴巴(11个),在学术界,过去十年产出最丰硕的机构为清华大学(26个)、斯坦福大学(26个)、卡内基梅隆大学(25个)。
但OpenAI、Anthropic、谷歌等头部厂商的多款超大规模模型,已不再公开训练代码、参数量、数据集规模、训练时长等核心技术细节。2025年,95个标杆模型中有80个未公开对应的训练代码,仅4个将代码完全开源。
当下,头部模型之间的性能差距正在持续缩小,且中美顶尖模型之间的性能鸿沟也在缩小。这或许意味着行业竞争焦点将转向成本、可靠性与真实世界实用性。
AI可斩获国际数学奥林匹克(IMO)金牌,却无法准确读表,凸显能力“锯齿状前沿”(大模型能力分布极度不均衡)。
Gemini Deep Think在IMO中夺得金牌,但顶尖模型读取模拟钟表的正确率仅为50.1%。AI智能体在真实计算机任务上的成功率从12%跃升至约66%,可跨操作系统运行,但在结构化基准测试中仍有约1/3的尝试失败。
5、AI能力持续超越基准,人类级测试快速饱和
生成式AI在面向大众市场推出后,三年时间实现了近53%的人口渗透率,增速超过个人电脑与互联网,这种快速普及正在转化为实实在在的价值:截至2026年初,美国消费者从生成式AI中获得的年度剩余价值,预计达到1720亿美元。
▲2025年关键AI事件
雇主调研中,1/3组织预期未来一年将裁员,近半数受访组织预期岗位无变化。服务运营、供应链、软件工程等领域的裁员预期最高。几乎所有公司中,预期裁员规模均已超过实际已发生的裁员。