国产大模型四巨头现场激辩:价格战对中国 AI 有利,但降价逼不出 AGI
我也请教一下各位,是否相信大模型是通往 AGI 之路的一个基石,亦或者大家在实际训练大模型的过程中,发现它可能依然只是一个数据的压缩,那可能对于产业界是非常有价值的,但并不一定能够通往 AGI?我想听听各位的看法,植麟?
对,我们比较相信大模型的第一性原理,就是通过不断地去提升这个模型的规模,就像仲远刚刚说的,它确实本质上是一个压缩。
它(Scaling law)只是在逼近 AGI, 但是光靠 Scaling law,我的理解是不够的。所以在这里面的话,如果从第一性上讲,其实刚才这个亚勤也提到这个事情,就是需要有范式的一个改变。
其实要说那个大模型,它是不是说一个基石,首先同意小川说的,他肯定是基石,那是不是基石之一?这是另外一个问题。
我个人是数学专业毕业的,所以我可能会比较严谨的去表达,我认为大模型一定是通往 AGI 这个方向上当前所有技术里面能走的最远的。
我们总在讨论 AGI,但似乎好像连 AGI 的定义,大家都没有广泛的共识。然后我不知道就是在各位的心里,这个 AGI 到底什么样叫 AGI?
首先,我觉得 AGI 的定义是重要的,但是它不一定需要在现在被非常精确地,有量化的定义。
所以植麟觉得,比如说我们需不需要有新的图灵测试,因为我们知道,如果按照传统的图灵测试,应该已经被大模型给攻克了。
对,传统图灵测试,可能到现在已经不完全适用了。
小川,咱们上次在央视对话栏目里面,其实你也提到,去年是智能纪元的元年,所以这智能纪元是 AGI 的纪元吗?亦或是你对 AGI 这块是怎么理解?
对,我刚刚提到今天四个元年,是因为我们掌握了这个 Scaling law,同时我们掌握了把语言变成数学,对吧?
大海,你被 cue 到了,作为数学家,你对于这个 AGI ,怎么去理解?
我会尝试从经济学的角度来去定义 AGI,我觉得从经济学的角度讲,如果我们去执行任何一个任务,它的边际成本都为零,这就是我们理想中的 AGI 了。
想请教一下张鹏,张总,最开始咱们做悟道系列,再在到后来咱们整个智谱系列这些大模型,你们最开始有考虑到它可能实现 AGI 吗?你对这个 AGI 是怎么去理解的?
其实你要说它是一个有一个很严格的定义,还是另外的什么东西。其实我更愿意相信它可能是我们的一种信念,是一个符号,它的内涵外延是在不断地变化的。
植麟对 Scaling law 还是特别的坚信吗?就是它会继续在未来的这些年会起作用吗?
对,就像我们刚刚说的,我觉得这个 Scaling law 没有本质的问题。
小川,你对 Scaling law 未来几年还会持续发挥作用,怎么看?
对,我觉得 Scaling law 是一定会发挥作用,这个到目前没有看到边界,还在持续的发挥,所以看到美国也有了马斯克,对吧?号称要买 30 万片,这个 B100 还是 B200 来做。所以在这种情况里面的话,这个美国确实在这方面的这个认真程度,甚至包括投入程度是会远高于中国的。
张鹏,你对 Scaling law 呢?
我刚才在讲 AGI 这个定义的时候,其实已经表达了相当的观点。
然后我想追问一个问题,其实我们现在到像 GPT-5,之前传过几次说要发布,但似乎一直在推迟。
我觉得这个因素可能有很多种,包括刚才说的,传说的这个所谓的 GPT-4.5,还有 GPT-5 什么时候发布,为什么一直大家传了好几次都没有发布,我觉得这个可能里面的因素会非常多,就拿我们自己来做,来说这个事情的话,其实我们自己也在选择一个道路,不断的去遵循这个 scaling la 往前前进。
大海,面壁智能在轻量级的这种大模型上,你认为 Scaling law 也是有效的吗?
我认为 Scaling law 是非常重要的。
对,然后大海,我们最近其实也关注到一个非常热门的新闻,就是关于开源社区的一件事情,像 Stanford 他们的这个团队,确实抄袭了咱们的 miniCPM,那我不知道你对这个事件怎么看呢?
对,最近这个事情在国内引起了非常大的反响,我们也完全没有想到我们的这个工作会以这种方式出圈,这个挺惶恐的。
其实百川也把自己的百川 1、百川 2 对外开源了。我不知道啊,当时咱们百川想把这个也花了不少钱训练的大模型对外开源的一个考量是啥?
我觉得是在市场上,第一个是有这样的一个需求,然后因为在当时去年,我们大概是在九月份就开了第二版,然后六月份开了第一版。
随着整个大模型的发展,确实 AI 安全问题也是被不断地讨论。各位都是做企业的,我想了解一下,就是说 AI 安全现在在我们大模型的产业界,怎么去看?是一个当下最急迫的问题吗?
对,我觉得 AI 安全是非常重要的,他可能不一定是当前最急迫,但是是一个我们需要提前去准备的事情,因为可能随着模型的进展,Scaling law 本身它的发展,是说每 N 个月吧?你可能就是算力乘十倍。
对,我觉得安全的话,有不同的内涵和外延。所以我想提三个安全相关的事情。
好,谢谢小川,张鹏,你对 AI 安全怎么看?
我们智谱其实一直很注意这个相关的一些事情。尤其在 AI 安全方面。因为我们应该前一段时间还签署了一个 AI 安全的前沿的人工智能安全的承诺是吧?
我比较同意。前面各位老板说到的这个观点,我认为现在这个阶段安全,主要还是聚焦在基础安全跟内容安全这两个方上。
在座的都是企业家,对于企业而言,可能虽然也很关注 AGI,但可能也更关注 ROI(投资回报率)。
对,我觉得这是很好问题。我觉得最终如果我们把时间线拉足够长的话,其实最终还是会回归这个价值本身。
小川,你对近期大模型的价格战怎么看?
我先说结论,今天价格战对于这个中国发展大模型特别好的事儿,现在结论,我是积极看待这样的一个事情。首先一个视角就是很多时候这个好不好,你得看是对单个的公司,还是对一个群体,一个整个市场?
我基本上是赞同小川这个观点的。
大海,咱们在端侧的模型会面临价格战的困扰吗?
其实我们做端侧,就是看到了端侧更早能更快落地的一个可能性。