问题在工具,根子在原理|同样是工具,chatgpt和电视机的差异,对使用者意味着什么?
五一假期,轻量分享。两个ai问题,指向同一个关键思想:驾驭chatgpt这类的ai利器,
问题在工具,根子在原理。
先看第一个问题。
同一个问题,
gpt-4o回答和o3回答,
有什么不同?
我目前使用o3作为主力模型。之前使用了一年多gpt-4o(24年5月发布~gpt-4.5发布),对gpt-4o也比较熟悉。我发现,即使是“介绍一下战国时代的楚怀王”这样的prompt(最近睡前夜读材料是春秋战国史记主题),o3和gpt-4o的回答都完全不同。
先看gpt-4o的回答:
再看o3的回答:
如何理解这种差异?
我们观察到的差异到底是什么?
为什么会出现这种差异?
背后反映了什么llm运行原理?
我来费曼一下:
不同的模型,就像不同的人,回答同一个问题的差异极大。需要重度使用,才能慢慢摸到这个模型的“脾性”。 可以这么类比:即使是同一个人,用大脑的 系统1(快思考) 和 系统2(慢思考) 回答同一个问题,结果也差异巨大;前者是“不过脑子”,模式识别,然后“生成”答案;后者是“think step by step”,经过逻辑推理后给出理性回答; 这个例子中,gpt-4o和o3类似于两个不同的人,gpt-4o的IQ是92,o3的智商是130+,分别用快思考和慢思考的方式回答问题,这造成了回答的巨大差异。
再分享第二个有趣问题。
同一个o3,
api调用和chatgpt内使用,
有什么不同?
熊友问:
为什么同样是 o3 ,我使用的 sider(一款AI提供商) 中的o3,没有你的o3强大?
问题是工具层面的,但答案在原理层面。
因为o3的本质是 agentic model(=强大的reasoning能力 + full tool-use,可以称为“任务模型”,“目标模型”或“智能体模型”)。openai给o3内置了8个强大工具,o3可以像agent那样自主调用、玩转这8个工具。这导致了chatgpt app里的o3和api版o3有本质差异。
这一点我在o3发布当天的介绍文章中就重点解释了。欢迎复习:openai全新发布首个agentic模型 o3
更详细的回答,当然得有请o3本人啦~
问题在工具,根子在原理
我每天会遇到五花八门的ai问题,但有一个显著的规律:
问题往往是术和器层面的,但这个问题之所以成为问题,是提问者对基本概念、ai基本原理的不理解。
人们习惯于不问原理,“直接用就行了”。这个习惯对大多数工具都没问题(电视电冰箱汽车甚至手机),但在ai工具上不行。为什么呢?
如果是抖音等 内容消费工具,即使内部的技术再复杂,你也不需要理解,一个人只需要被动消极消费信息即可。
但是,ai 不是被动工具而是主动工具 ,ai工具使用者 不是消费信息而是主动创造,这就决定了不理解基本概念、不了解运作原理、不建立基本的学科知识体系的话,术和器层面的问题必然层出不穷。
如何解决?我的ai内容分享就是道法术器兼顾的,关注我,阅读我的ai分享,基本上大方向就没问题拉,哈哈。
祝假期快乐~
点赞 ♥︎ 转发 ♥︎ 评论