作为豆包死忠用户,我最喜欢它的点并不是常见的赞美 “体验好”
7 月在犬校聊到豆包,作为豆包死忠用户,我最喜欢豆包的点并不是常见的赞美 “体验好”。
豆包客户端发布的时候,所有竞品只知道跟着 ChatGPT 抄作业,并且是相比 ChatGPT 劣化许多的客户端体验。当时豆包做了两件完全不一样的产品决策:
轻量级的搜索,满足「快速找答案」的问答场景,豆包主线程对话对这个心智居功至伟
强大的 VUI(也要付出很高的算力成本),用户体验碾压一切竞品
虽然豆包也通过浏览器插件、智能体和文生图分头下注,但轻量级搜索的主路径是很清晰的——无需选择新建还是继承对话(抹除选择的摩擦力),默认进入豆包主线程对话,在不经思考的极短路径上,养成用户的快速问答心智,为此牺牲一定的分支路径的演变潜力。
与此同时,竞品不仅客户端体验差,更加搞不清楚主线体验是什么,觉得 “一切皆有可能”,鼓励用户多样性地使用大模型去激发应用潜力,在主路径尚不成熟的基础上让用户帮自己探路。
当然,这也是跟着 ChatGPT 抄作业。(基座能力差这么多,抄你妹啊)
而豆包下重注在「快速找答案」的轻量级搜索场景,主路径聚焦。“主线程对话,强大的 VUI ” 这些和竞品相比的产品特色,都是为了把主路径打穿,在主路径上反复打磨用户体验。
然后真的就打穿了主路径。
回想那时候,换我上,我会做和豆包一样的决策。做这个决策最难的地方在于说服上级:
聚焦于平替轻量级搜索,一定会牺牲一定的分支路径的演变潜力
一开始大模型的能力不足,并没有把握平替搜索
有取则有舍。
但在我看来,哪怕是有限替代轻量级搜索,也是当时大模型基座最坚实的用户价值。“分支路径的演变潜力” 则是没看到现实支点的空中楼阁,只能等待 big opportunity 平空掉落。因此从我信仰的演变论出发,我会选择从聚焦轻量级搜索入手,从一鸟在手的用户价值入手,再一步步观察泛化的机遇。
这个产品思路,几乎注定无法说服大厂高层,无法满足他们对于星辰大海的野望。(字节这次倒是英明神武)
到目前为止,赢家豆包。
虽然我信仰的演变论并不是 100% 成功,偶尔被天降大任砸中的人会战胜 “可见的,坚实的用户价值”,但演变论是成功率最高的路径没有之一,每一步都有坚实的用户价值和产品逻辑支撑(哪怕每一步的步伐不是很大),而不是等待大任如苹果平空掉落。🍎
须知,大厂高层对星辰大海的野望,在现在的技术基建和行业生态下,约等于人类 10 年内建立火星殖民地。所以他们毫不迟疑地把宝押在了大模型的下一次技术涌现上,瞧不起平替轻量级搜索这点小打小闹。结果豆包千万日活了,十倍领先,又倒过来眼红眼酸。这群不高增长不舒服斯基的利欲熏心的废物。
增长来自于兑现用户价值,而不是虚构商业价值。
犬校同学对此发表观点:
纯银之所以觉得豆包超预期,我觉得,是因为纯银不是 ChatGPT 的核心用户。
我想换一个视角讨论这个问题。
我的确至今都不是 ChatGPT 的核心用户——虽然我是 ChatGPT 的第一批用户。对我来说,豆包在我最常用的场景上是超越 ChatGPT 的,并且影响了我的 AI 心智。
这种优势,在我看来有这么几点。
1、
打开豆包,默认进入主线程对话,继承之前的对话历史。这样就形成了不假思索的使用习惯,一进来就提问,语境一目了然。相比之下,使用 ChatGPT 有一个短暂的思考过程:我是新开对话呢,还是继承之前的对话?思考带来了摩擦力,摩擦力降低了效率。
对于 ChatGPT 探索多路径、多场景来说,避免上下文污染,选择对话是必然的。但对于豆包聚焦轻量级搜索,快速找答案来说,摩擦力对于建立用户心智是一个阻碍。所以我个人的习惯是,快速找答案问豆包,深度对话问 ChatGPT。
在这件事情上,ChatGPT 选择了更完整的使用场景,向用户行为的演变倾斜;而豆包选择了有取舍的场景,向快速建立用户心智倾斜。
有意思的是,ChatGPT 在全世界范围内取得了成功,但成功并没有被国内竞品复制,而豆包在中国取得了成功。这中间的差异是什么呢?我暂时没想明白。对我个人来说,打开 VPN 和选择对话的摩擦力导致我至今无法将 ChatGPT 作为移动端主 AI 来使用,用豆包则不假思索,轻松愉快。
2、
VUI——VUI 对于豆包的成功居功至伟。这里不仅仅是 VUI 的高识别率(也付出了金钱上的高成本),还包括完美的交互体验。
举个最简单的例子,在文本输入框模式下,豆包依然能长按输入框进入 VUI 模式。干得漂亮!
豆包的交互从一开始就强烈地鼓励你用语音提问,豆包这么做的时候,ChatGPT 甚至还没有 VUI 输入。这不仅仅是一个交互设计的问题,也不仅仅是成本的问题,而是和 “轻量级搜索,快速找答案” 的主路径强耦合。豆包不是为了做 VUI 而做 VUI,是为了主线定位而做好 VUI,目的与边界明确,才能把这个功能打磨得如此出色。
3、
其他一些零零散散的优势,想到哪里说到哪里。
个人印象里,豆包一开始吐 token 比 ChatGPT 快(现在速度相似),对于快速找答案而言,一开始就找到了节奏上的最佳平衡点。
豆包在吐 token 的过程中,可以随时打断,随时重新开始,这种显而易见的交互体验,kimi 直到豆包发布半年后都没有跟(刚才测试了一下,现在已经跟了)。用户提问有误,重新开始是非常常见的场景,如果需要等待或是手动打断,都会带来摩擦力,用新的输入直接打断才是符合直觉的设计。哪怕有着错误的打断,两三次以后用户自己就适应了。
豆包的语言风格虽然远不如 ChatGPT,但相比文心一言、通义千问,kimi 这些迂夫子体,至少是合格的语感。对语感的调教不过不失。而国内大多数竞品的语感都很拉胯,和理工男拉胯的语言审美有关。
token 的语音输出模式没有效率,但很新奇,加强了品牌印象,音色也很自然。
浏览器插件拓展了豆包的工具边界,OCR 和翻译都相当好用。
语音对话场景,直到今天豆包依然是国内头牌,当然没法跟 ChatGPT 比,但同样拓展了支线场景,加强了心智和品牌。
综上,豆包聚焦并打穿了 “轻量级搜索,快速找答案” 这个主路径,而我是这个主路径的典型用户。ChatGPT 的深度用法大部分是我不需要的。因此我才说,豆包对我来说是超预期的,是最近两年的最佳国产 APP。在它面前,DeepSeek 也好,夸克也好,客户端体验完败。
豆包这一系列动作,并不能说特别高明,特别有创造力,而是特别精准,取舍得当,有着强大的洞察力。
真正困难的,并非豆包团队做出这样的取舍,而是字节高层认可这样的取舍,不跟着 ChatGPT 抄作业,先把做了大量减法的,用户价值坚实的第一站打下来,并不幻想用户帮自己找到星辰大海一般的未来前景;或是幻想随着大模型的能力涌现,这个美好前景会从天而降。至今为止,其他家大厂的幻想依然是最终幻想,字节与微信依然是 C 端之王。
点击【阅读原文】,可见犬校最近一年的好帖索引。