《华盛顿邮报》社论:中国开源AI会终结美国在人工智能领域的霸权吗?
1月27日美股因中国AI公司DeepSeek发布新模型而大幅下跌,引发市场震动。美国主流报纸之一的《华盛顿邮报》罕见以社论形式聚焦DeepSeek,指出其开源模式正挑战美国的科技霸权,或重塑全球AI格局。
埃里克·施密特(Eric Schmidt),谷歌前首席执行官兼董事长,目前是施密特科学研究院的联合创始人,并担任非党派智库“特别竞争研究项目”(Special Competitive Studies Project)的主席。达瓦尔·阿乔达(Dhaval Adjodah)是MakerMaker.AI的联合创始人兼首席执行官。
近年来,人工智能领域发展迅猛,几乎成了老生常谈。然而,就在最近,即使是最前沿的AI研究者也被一家中国公司震惊了。
上周,AI公司DeepSeek发布了其R1推理模型,该模型在逻辑任务(包括数学和编程)上的表现可媲美OpenAI的o1模型(且远优于ChatGPT系列模型),运行成本却仅为OpenAI的约2%。更令人惊讶的是,本周一,DeepSeek又推出了Janus Pro,这是一款足够小巧以至于能在笔记本电脑上运行的模型,可生成超越OpenAI的Dall⋅E 3的合成图像。DeepSeek的AI创新速度正在震撼全球。
更值得注意的是,DeepSeek的所有模型均为开源——这意味着其权重公开,任何人都可以复现并在其基础上开发。
在这个特殊时刻,一家中国公司成为事实上的开源领头羊,而美国的大多数主要公司(除Meta外)依然选择对其方法论严格保密。实际上,这反映了中国AI公司日益增长的趋势——从初创企业如Minimax到科技巨头如阿里巴巴,都在为全球开发者免费提供AI模型的访问权限。
迄今为止,像OpenAI的o3和Anthropic的Claude 3 Opus这样封闭源代码的模型被认为是行业标准,拥有最先进的功能——它们都诞生于美国。而开源模型和中国的模型曾被认为至少落后数月。然而,DeepSeek的R1和Janus Pro显示,技术霸权的天平可能会迅速倾斜。这些模型的推出动摇了股票市场,导致美国科技股大幅下跌。权力的天平似乎正沿着两条关键轴线发生转移:一是美国与中国之间,二是封闭与开源模型之间。
封闭模型的支持者押注,通过保护模型权重和训练方法论,他们可以维持能力差距。而开源模型的倡导者则认为,透明性——允许他人基于其工作进行构建——可以让这些系统迅速赶超更大的封闭模型。如果开源理论正确,那么AI生态系统可能会被颠覆。开源模型的使用成本通常更低,因此当两个能力相当的模型摆在面前,一个是开源的,一个是封闭的,开源模型更可能被广泛采用,从而获得战略优势。
美国已经拥有世界上最好的封闭模型。为了保持竞争力,我们还必须支持一个充满活力的开源生态系统的发展。
无论是开源与封闭模型的竞争,还是中美之间的较量,目前都尚无明确的赢家。然而,如果DeepSeek能够以远少于美国科技巨头的资源与之竞争,美国的大型科技公司显然面临着越来越大的压力。出口管制的初衷是阻止中国获取最先进的计算机芯片,从而阻碍其跟上步伐的能力。然而,事实上,中国高性能芯片的相对稀缺可能反而促使了中国公司和研究人员提高效率,并发现了显著降低训练成本的新方法。例如,DeepSeek证明,通过绕过传统的监督微调阶段,大型模型的训练效率可以得到提高。他们甚至创建了R1-Zero,一个省略这一训练步骤的模型,以挑战研究界对微调不可或缺性的假设。
DeepSeek的成功还引发了对预训练重要性的质疑。预训练是指基于大量文本训练越来越大的模型以预测下一个词汇,这一过程需要大量的图形处理单元(GPU)和数据投入。OpenAI的联合创始人伊利亚·苏茨克弗(Ilya Sutskever)最近甚至指出,我们可能很快就会耗尽互联网上可用的数据。