ai 三人行:效果最佳的 llm 多模型搭配方案(2025年8月版)
gpt-5的发布,距离 gpt-4 (2023年3月15日)接近2年半。不出意外,在gpt-6之前,gpt-5将会长期陪伴我们,在工作学习生活中扮演重要作用。
上周五晚上,我在学习研究测试一天后,做了一个day one版本的gpt-5讲座。我肯定没有明确判断gpt-5是“炸裂”或者“扑街”,因为,这种复杂的工具,必然需要我们上百小时的深入研究。
不出意外,我还会在2周、1个月、3个月等不同时点,再做关于gpt-5的主题分享。
下面是我让课代表gemini 2.5 pro 做的讲义,供有需要的朋友参考。讲座最后,谈到了我当前的 llm配置,与你分享:
下面是讲义 👇
part1:gpt-5 全面解析
对应讲座时间段:10分~40分
官方信息解读
核心观点:获取一手信息的重要性,强调阅读官方博客。 一句话总结:gpt-5是gpt系列和o系列(thinking model)的统一模型,将聊天和推理范式融合。 模型版本与可用性: 统一入口:Free、Plus、Pro用户均可使用gpt-5,无需手动选择模型。 限额与降级:不同用户有不同限额,用完后会降级。 Pro特权:独享权限,可选择使用旧模型。 UI变化:背景色变为渐变,工具整合到“+”号中,简化操作。
核心特性与变化
专家级智能 (Expert Intelligence) : 定位:从“大学生”水平提升至“专家级”。 反思:鼓励实践,而非主观臆断其能力。 个人应用举例:使用“学习模式”和“deep research”辅助孩子学习《春江花月夜》,效果超越人类教师。 性能与价格: 推理能力:thinking版本达到o3的五星水平。 速度:与gpt-4o相当。 价格:比o3更便宜,体现 “智能即资源”的时代特征(智能时代的本质:智能按斤称,可包月)。 **上下文窗口 (Context Window)**: 容量:从12.8万/20万token提升至40万token。 影响:Deep Research能力大幅提升,可一次性输出6万字报告。(勘误:后续研究发现,deep research的底层模型仍然是o3-deep-research,但报告的实际输出确实比前几个月有改善🤣) 合成数据训练: 趋势:ai智能的提升开始依赖ai自身产生的高质量数据。 对个人的启发:建议大家像训练gpt-5一样,通过与ai对话和深度研究来“训练”自己,学习ai合成的数据。 “学习模式”的震撼:以“多巴胺”为例,说明ai教学的丰富度和个性化远超传统方式。
part2:gpt-5实战测试
对应的讲座时间段:40分~75分
逻辑与思考能力测试
关键测试题:“医生是男孩的父亲,但说不能给儿子做手术”,只有gpt-5 thinking能正确回答为“父亲”,揭示其真正具备思考能力,而非“背答案”。 信息整合能力:“梁启超的儿媳妇是谁?”,展示了thinking版本条理清晰、全面准确的信息整合能力,远超人类效率。 深度思考与推荐:“最引人沉思的ai主题影视作品”,对比gpt-5、thinking、Pro三个版本的回答,展示了从基础推荐到主题分类、观影路线、深度讨论方向的层层递进,体现了不同版本智能的深度。
Coding能力
观点:Coding将成为人人必备的技能。 场景举例:用几分钟时间生成一个本地网页APP,用于演示“立方体展开与折叠”,解决实际问题。
写作能力
观点:gpt-5的文字质量超过了大部分读者的大脑分辨率和简中互联网信息质量。 与gpt-4.5对比: gpt-4.5在语言的微妙之处(subtlety & nuances)上仍具优势,但价格昂贵且即将下线。 gpt-5虽稍逊一筹,但已足够优秀,且潜力巨大。 测试案例: 命题作文:以余华风格写“鲁迅笔下的三个人”,展示了其不错的写作功底。 知识融合创作:悼念gpt-4.5的文章,完美融合了用户提供的背景信息和想法。
其他能力测试
幽默与风格模仿:能够精准模仿各种风格,指哪打哪。 复杂逻辑推理:“38分改88分”的笑话,只有gpt-5 thinking能稳定答对。 图文理解:“鸭子支持全聚德,鸡支持肯德基”的讽刺漫画,gpt-5的回答质量有可见提升。 数学能力: 高考题:不在话下。 小学几何题(数三角形):普通版不行,但gpt-5 thinking具备抽象逻辑推理能力,可以解决。
part3 当下的ai使用最佳实践
对应讲座的时间段:75~95分
gpt-5使用技巧
UI与设置: 模型选择:Pro用户可选择显示传统模型。 个性化:新增“强调色”和多种“个性选择”(如毒舌、倾听者)。 功能细节: 重试:可让回答“更长”或“更简洁”。 Connectors:打通Google Drive, Notion等个人数据,实现私人gpt。 不同版本区别: 核心差异:上下文窗口(免费8k,Plus/Pro 128k)。 Pro价值:无限额、独享gpt-5 Pro、以及巨大的上下文窗口带来的知识管理和无限对话延展能力。
“ai三人行”:多模型协同策略
个人实践:同时订阅gpt、Gemini、Claude,每月花费约240美金。 黄仁勋的方法:一个问题问三个ai,组成专家团。
模型选择策略: 默认:gpt-5 thinking。 长文本处理:Gemini 2.5 Pro。 信息搜索与整合:gpt-5 thinking(碾压级优势)。 Coding & MCP:Claude Code。 写作:gpt-5、gpt-4.5(且用且珍惜)。 Deep Research:Openai(绝对首选)。
part4 时代反思与个人成长
对应时间段:95分~115分
ai时代的人类处境
三个世界理论:人与人虽然生活在同一个物理世界(世界一),但主观情感(世界二)和客观知识(世界三)的差异巨大。 行为分化:少数人废寝忘食地拥抱ai,大多数人仍停留在惯性式的消费信息和娱乐。 对孩子的警示:应试教育培养出的能力在ai面前相形见绌,家长有责任引导孩子面向未来学习。
知识与经验的悖论
问题:知识唾手可得,但人类积累经验、培养能力的机会是否会减少?ai是否会消灭“学徒”角色,导致能力断层? 网络故障案例:不懂RSSI、Noise等基础概念,就无法解决实际问题,凸显了基础知识体系的重要性。 解决方案:成为更强的学习者,实现指数式成长。必须驾驭ai,将学习效率提升10倍以上。
核心结论
对gpt-5的态度:不盲目吹捧,也不轻易否定,其价值在于实际应用。 方法论:采用“ai三人行”的多模型协同策略。 个人选择:终身学习是应对ai时代的唯一出路。
part5 问答与互动
ai学习与疲劳:通过构建知识体系(如使用Logseq),将学习与解决实际问题结合,可以获得持续的正反馈和愉悦感(优质多巴胺)。 gpt-5与gpt-4.5的味道:承认有心理因素,但强调gpt-5的质量已远超大多数信息源,足以产出“十万加”内容。 如何让孩子适应ai时代:推荐《内驱式学习》,先培养孩子的语言能力、世界知识和内驱力,再引入ai工具。 工具选择(Logseq vs Obsidian):两个都用,Logseq更硬核、结构化,适合少数人;Obsidian更大众化。 会员订阅的必要性:每月300元的投入,是对自己思维方式和未来能力的投资,通过实践会发现不同ai的巨大差异和价值。 ai写作的看法:反对批量生产垃圾信息,提倡人与ai结对子,进行更高质量的思考和创作。
讲座视频回看
点击“阅读原文”,或识别二维码,直达讲座视频