非凡油条

DeepSeek-V4终于来了,有人却在互撕

Image

DeepSeek-V4终于发布了。

百万字超长上下文、适配国产算力、突出的性价比,我们熟悉的那个DeepSeek,在4月24日那天回来了。

回来的不只DeepSeek,过去十天内,中美两国大模型团队新品频发。

4月16日,Anthropic发布旗舰新模型Claude Opus 4.7。

4月20日,月之暗面发布并开源Kimi K2.6模型。

4月23日,OpenAI公布了新模型GPT-5.5。

新模型密集发布,整个行业竞争之激烈可想而知,在竞争中,AI技术正不断突破旧有的极限,变得更强大、更适配、性价比更高。

然而在技术竞争之外,另一种冲突在大洋彼岸的AI圈爆发。

“他们的故事建立在恐惧、限制,以及一小群精英应该控制AI的理念之上。”

OpenAI在4月12日发布内部备忘录,直接炮轰另一家AI巨头Anthropic,其中这句话直指Anthropic的安全叙事是虚伪的。

这份内部备忘录迅速被媒体公开,显而易见,OpenAI和Anthropic之间的竞争,早已上升到舆论战层面。

好好的卷技术,怎么打起口水战了?

闭源围城:

OpenAI与Anthropic的"信任绞杀战"

如果从更高层次的“闭源vs开源”视角,审视OpenAI和Anthropic的互撕,会发现OpenAI提到的“安全叙事”不是技术事实,更像是商业叙事。

因为Anthropic和OpenAI推出的最新模型都是闭源的,外界无法直接检查它们的对齐机制、训练数据或推理逻辑。

没有外界验证,OpenAI在安全问题上对Anthropic的言论缺少可信第三方判断,只是某种舆论战。

Anthropic此前也攻击过OpenAI。

在2026年超级碗期间,Anthropic投放广告,嘲讽OpenAI在ChatGPT中插入广告。

Anthropic从广告角度攻击OpenAI,也是利用了用户对闭源模型的无力感。你无法本地运行模型,也就不能确认OpenAI是否真的在拿你的对话训练广告模型,ChatGPT回复你什么就是什么,你摆脱不了广告。

OpenAI和Anthropic这你来我往,攻击的往往不是模型能力,而是对方的商业动机和信任根基。

重点不是“你技术不行”,而是“你不值得信任”,Anthropic和OpenAI上升到直接针对品牌的争吵,以打击对方的用户基础。

美国的两家闭源AI大厂,攻击对方,动摇对方用户的信心,本质上还是都想成为AI时代独大的那个闭源操作系统,控制入口、标准乃至定价权。

一旦你选择了某家的API或订阅服务,数据、工作流、生态集成的迁移成本被刻意设计得极高。所以它们必须在用户做出选择前,用"信任/不信任"来抢占心智。

而赢家通吃的前景,自然会驱使闭源AI巨头展开排他性极强的商业竞争。

开源接力:

没有口水,技术共享

在美国两大闭源AI巨头陷入口水战的时候,中国的开源大模型却形成了微妙的默契。

四月份,Kimi K2.6和DeepSeek V4,两大国产领先开源大模型先后发布。

因为开源,这两款最新模型都容易受到外界检视。

像Tuki这样的技术大佬惊讶地发现,在Anthropic和OpenAI在互相攻击的时候,Kimi和DeepSeek居然在技术上互相借鉴,协同进化,还把成果大大方方开源了。

Image

早在Kimi K2时期,月之暗面就用了DeepSeek开源的MLA架构。

MLA架构是把KV Cache压缩率做到93%以上的注意力机制,DeepSeek就这么开源了,月之暗面也就这么用了。

就这么简单,没有授权谈判,没有专利纠纷,更没有冗长无聊的口水战。

DeepSeek的原创,别人用多了就是业界标准。

而月之暗面团队对开源的Muon优化器做出关键改进,推出MuonClip,在万亿参数规模上验证了稳定性。DeepSeek也直接跟进,把Muon优化器用在了DeepSeek V4上。

‌“想学啊?我教你啊。”

一切就是这样的单纯,直接,光风霁月,仿佛回到了互联网刚出现,人人都无私分享‌的美好日子。

这是开源社区开放包容,共筑生态的基础设施民主化精神。

Kimi和DeepSeek都得益于开源,作出的成果也无私地回馈开源社区,不搞排他式竞争,用技术说话。

闭源锁用户,开源建生态:

AI权力的重新分配

表面上看,美国模型大厂陷入内斗,中国大模型则互鉴共进。

但要是看到更深一层,就会发现,这就是闭源和开源两条路线的必然结果。

闭源路线的竞争是排他的、零和的。

选择一家闭源大模型,你的数据、工作流和生态集成被锁定在一个封闭系统中,高迁移成本让你难以中途跳船。

这也就意味着闭源模型厂商必须在用户决策前争夺信任,否则就有很大可能永久错失用户。

所以OpenAI和Anthropic走上了品牌攻击的舆论战,这是闭源商业模式的必然产物。

开源路线的逻辑则不同。

锁定用户并不是最首要的,更重要的是共同建设一个开放的AI基础设施层。

模型的权重公开、代码开源,意味着任何人都可以fork、修改、部署,改进的成果也自然回馈社区。这种飞轮效应让生态整体的创新速度超过了任何一家封闭公司,甚至会驱使参与者作出有利于上下游整体发展的艰难探索。

比如芯片短缺,成了大模型发展的瓶颈,阻碍智能向上突破和成本向下削减。

月之暗面最近发布了一篇题为《Prefill-as-a-Service》的论文,提出了大模型推理的新方案,让预填充和解码可以在不同的芯片上分别运行,推理过程也就可以采用谷歌、AWS、华为昇腾、阿里巴巴平头哥等供应商的更多类型的芯片,缓解缺芯问题。

新发布的DeepSeek-V4,在华为昇腾950上实现了高吞吐、低时延的推理部署。这是实实在在提供了英伟达之外的适配选项,下半年昇腾950超节点批量上市后,DeepSeek-V4的API调用价格还有望大幅下调。

这就是共同建设开源生态,在增量市场中扩大蛋糕的具体体现。没有内卷,只有生态互补。

DeepSeek-V4聚焦基础模型的核心能力提升,提供性能紧追闭源先进水平、性价比高的开源选项。

Kimi K2.6则专注Agent工程化落地,为模型在真实工作场景下的应用落地打通了路径。

两者共同探索AI能力边界,不仅是为中国,也为全世界提供了美国闭源大模型之外的开源先进选项。

当然,或许有人依然认为国产模型落后,但这就像当年的“两弹一星”工程,更关键的是,拥有自研模型,提供另一种可能,这本身就是意义。

Image

DeepSeek-V4上线:使用华为芯片训练,性能比Gemini差3-6个月,价格优势明显 https://mp.weixin.qq.com/s/HkrzyjONGua1CfBGRSDo_A

Anthropic又发新模型了,但手里藏着更强的“杀招” https://mp.weixin.qq.com/s/LMpSq9iwVZaWKA8B__MLgw

Kimi K2.6 发布并开源,全面精进代码和 Agent 集群能力 https://mp.weixin.qq.com/s/6jfSSCcq7HMg-qXrsc4OVg

中国芯片,DeepSeek与Kimi的隐秘交点 https://mp.weixin.qq.com/s/klUy5J-MRjyKOcF_ZlKl8A

DeepSeek-V4官宣时的这行小字,藏着关键细节 https://mp.weixin.qq.com/s/mp9MRz3GMB0uG038AW8ZQg

深夜王炸,GPT-5.5发布 https://mp.weixin.qq.com/s/ywIqMaoNCSqgl9lSq-n3WA

OpenAI 四页「小作文」曝光,炮轰 Anthropic 靠恐惧卖货,营收注水 80 亿 https://mp.weixin.qq.com/s/bg3ulpXVks0XbtkqO-Pmmg

IPO前的OpenAI与Anthropic,都想继续吵下去 https://mp.weixin.qq.com/s/A_Ilm6vg_SqAPuX9-PFz2g

Image
Image
Image
Image