别看Llama 4刷榜,实则在follow DeepSeek和Qwen
别看Llama 4刷榜,实则在follow DeepSeek?
Llama4开源了,总结起来就3句话:
1、首次使用MoE
2、最大版本参数量2T,可能是目前全球第一
3、最小版本109B参数,激活17B,性价比最高。
MoE显然是follow了DeepSeek V3的MoE上的成功。
最大参数量,也是follow当时V3放出615B时的劲爆效果,无非就是堆硬件。
最小版本打性价比,无疑是follow Qwen 32b的产品策略。
看起来小扎还没有找到可差异化的点。
个人认为大模型的共性是几点
1、能耗比
2、能力天花板
第一点有利于私有化商业模式,第二点加第一点则更有利于云化商业模式。
所以接下来可能会比拼的是垂直领域大模型应用案例和能耗比。
能力天花板是大厂的战场,就跟数据库打榜一样,打榜是大厂最喜欢干的。
能耗比战场还有就是出现在硬件厂商方面,等不是英伟达一家独大时,就会出现硬件厂商性价比打榜的局面。