PostgreSQL码农集散地

别看Llama 4刷榜,实则在follow DeepSeek和Qwen

别看Llama 4刷榜,实则在follow DeepSeek?

Llama4开源了,总结起来就3句话:

1、首次使用MoE

2、最大版本参数量2T,可能是目前全球第一

3、最小版本109B参数,激活17B,性价比最高。

MoE显然是follow了DeepSeek V3的MoE上的成功。

最大参数量,也是follow当时V3放出615B时的劲爆效果,无非就是堆硬件。

最小版本打性价比,无疑是follow Qwen 32b的产品策略。

看起来小扎还没有找到可差异化的点。

个人认为大模型的共性是几点

1、能耗比

2、能力天花板

第一点有利于私有化商业模式,第二点加第一点则更有利于云化商业模式。

所以接下来可能会比拼的是垂直领域大模型应用案例和能耗比。

能力天花板是大厂的战场,就跟数据库打榜一样,打榜是大厂最喜欢干的。

能耗比战场还有就是出现在硬件厂商方面,等不是英伟达一家独大时,就会出现硬件厂商性价比打榜的局面。