大模型“六小虎”的2024:大厂强势,蹊径难寻
【编者按】以变革应对变局,以远见超越未见。四木相对论 、大象新闻、大象财富联合腾讯新闻、腾讯财经、腾讯科技推出2024年终策划《变局之下》,回望2024、展望2025,让洞见穿越时间,向未来寻求确定。
作者 | 四木相对论
现状:巨头“搅局”,赚钱的业务寥寥
(麦当劳AI点单系统错误地给顾客添加了数百美元的鸡块)
(华尔街日报报道)
预训练的规模秘诀失效,OpenAI和Anthropic给出的解法,是通过强化学习(RL)提升模型推理能力。
2024年9月中,OpenAI上线了首个推理模型--o1。12月底,进阶版推理模型o3上线。它展现出大模型在科学、编码、数学等领域解决复杂问题的能力,引来各家追随。
11月,也就是OpenAI的 o1 发布两个月后,国内至少有近10个团队在复现o1。
另一种声音是质疑o1、o3的“应用场景太狭窄”。在数学、代码之外,它适配的场景并不多。如果再算上成本,落地前景并不明朗。
(科技咨询公司Omdia估计,2024年买卡最多的国内公司是字节和腾讯)
(DeepSeek于12月26日发布通用模型DeepSeek-V3,图源DeepSeek官网)