GenAI新世界

2025 AI盘点:十大 AI“残次品”

Image
作者|董道力
邮箱|[email protected]

2025 年,AI 行业最大的共识不是技术突破,而是集体性的"落差管理失败"。

从苹果到 Meta,从创业公司到科技巨头,几乎所有玩家都在用同一套话术:更智能、更自主、改变一切。但当产品真正落地,用户发现的往往是,demo 很惊艳,日常很鸡肋,宣传很激进,交付很保守,承诺是助理,实际是玩具。

这份盘点聚焦的不是"技术失败",而是"期待管理崩盘"。以下产品并非垃圾,它们只是在"说到"和"做到"之间,留下了一道让用户从兴奋到失望的鸿沟。

Apple Intelligence

期待:iPhone Siri 变身"会办事的助理"(给 AI 手机打个样)。

落差:苹果在 2025 年 3 月确认部分 Siri AI 升级要拖到 2026 年,高管 Craig Federighi 和 Greg Joswiak 在 WWDC 后的采访中承认存在质量问题。观感就是,讲得很满,交付很慢。

对于习惯了苹果"发布即可用"节奏的用户来说,这种"先画饼再慢慢烤"的策略,本身就是一次信任透支。购买 iPhone 16 期待 AI 功能的用户对延期极不满意,甚至引发了集体诉讼。更尴尬的是,这个延期不是几个月,原计划 iOS 18.4 的功能现在要等到 iOS 26.4,也就是 2026 年春天

当你的 AI 助理连自己的上线时间都算不准,还能指望它帮你安排日程吗?

Image

OpenAI Sora 2

期待:AI 版 TikTok,5 天破百万下载,登顶 App Store。什么才是 AI 原生社交平台啊(战术后仰)?

落差:从霸榜到冷清,Sora 2 只用了两个月。a16z 合伙人公开的数据:首日留存 10%,7 天 2%,30 天 1%,60 天接近 0%,典型的"来得快,走得更快"。

推荐算法糟糕到总推同质化视频,100% AI 生成的内容缺乏人味儿。更要命的是成片率只有 5%-10%,生成 10 个视频才能得到 1 个能用的,对于创作者来说是够用了,但对于社交平台的用户,还不行。

最讽刺的是,创作者把 Sora 最好的内容导出后发到 Instagram 和 TikTok,Sora 自己的社区成了"素材代工厂"。用户的心态很简单:生成几个搞怪视频发朋友圈获得社交货币后,新鲜感就消退了。

就算你有最强的视频生成模型,不懂短视频运营,照样做不出第二个 TikTok。毕竟技术再强,也拯救不了一个把用户当"免费内容农民工"的产品。

Image

Perplexity Comet

期待:AI 浏览器替你下单、填表、办事(AI 浏览器它来了)。

落差:2025 年 11 月被亚马逊告上联邦法院。亚马逊指控它"伪装成人类浏览器访问"并"秘密访问客户账户",带来安全风险。

诉讼称 Comet 使用自动化工具登录 Amazon 账户、浏览商品、下单,却伪装成普通 Chrome 用户。亚马逊在诉状中写道:"Perplexity 的行为必须停止。使用代码而非撬锁工具入侵,并不意味着就合法" 。

这类产品一旦被贴上"安全风险"标签,口碑会断崖式下跌,没人愿意让一个可能导致账号被封的 AI 碰自己的购物车。Perplexity 辩称这是"用户授权的合法操作",但当你的"创新"让全球最大电商平台请律师团出马时,或许该反思一下这创新的方向是不是跑偏了。

Image

Meta Llama 4

期待:开源阵营"追平甚至反超闭源"的新旗帜(开源是个生意)。

落差:实际跑下来,体感并没那么惊艳,尤其在真实任务中表现不如预期。更麻烦的是,围绕基准测试的版本差异与透明度争议迅速发酵,讨论从"模型能力"滑向"到底测的是什么、我拿到的又是什么"。

当开源社区开始质疑 benchmark 的真实性,口碑就很难靠迭代补回来了。开源的魅力在于透明,一旦透明度本身成为争议焦点,那这个开源项目离"信任危机"也就不远了。

与此同时,以 DeepSeek、Kimi、Qwen 为代表的中国"开源御三家"正在改写规则。当 Meta 还在用限制性许可证玩"开源 cosplay"时,中国大模型已经用 MIT 协议和 1/100 的成本优势证明:开源大模型的旗帜,不在硅谷在中国。

Image

Anthropic MCP

期待: AI 时代的USB Type-C接口,终结大模型应用的数据孤岛,实现“一次开发,全模型通用”。(一天到晚想要制定标准)

落差: 2025 年 11 月,MCP 一周岁生日,官方宣布适配了 2000+ Server,但社区反应静得可怕。因为开发者发现了一个无法解决的“MCP 悖论”:工具装得越多,AI 越蠢,且越贵。 MCP 的致命伤在于它必须占用上下文。仅仅是挂载 GitHub 官方定义的 93 个工具,就要消耗 5.5 万 Token。后果是,你还没开始问问题,钱包已经瘪了,而且 Context 被塞满后,模型的注意力被严重稀释,挂载了计算器工具的 AI,甚至会把减法算成加法。

Image

Microsoft Recall(2025 版)

期待:"拥有照相记忆的 PC",随时回溯任何历史画面(微软砍刀部又来业绩了)。

落差:虽然加了本地加密,但企业级 IT 部门直接判了死刑。绝大多数公司出于合规考量,通过组策略默认禁用该功能。

对个人用户,微软为了安全把截图权限阉割得太狠。即时通讯、文档草稿等关键信息因"敏感应用屏蔽"根本没存下来。最终沦为占用硬盘的"系统级臃肿软件"。

微软用实践证明了一个道理:当你的"超能力"是"记住一切"时,用户第一反应不是兴奋,而是恐惧。没人想要一个连自己都不知道它记了什么的"电子大脑"。

Image

AI 独立硬件 2.0(Humane/Rabbit 的"继任者们")

期待:"告别手机"的 AI 挂件/眼镜,用更强模型挽救硬件(别挣扎了,外面全是手机)。

落差:证明了"手机+耳机"才是终极形态。不管模型多强,这类独立硬件依然没解决"交互带宽"问题。语音效率太低,投影屏幕看不清,还要频繁掏出手机做联网鉴权。

2025 年彻底终结了"AI 独立终端"的幻想,确认 AI 只是手机的一个功能,而不是取代手机的新物种。原来最好的 AI 硬件,就是你口袋里已经有的那个,只不过需要更聪明的软件,而不是更多的硬件。

Image

Ubisoft / NVIDIA ACE

期待: NPC 彻底告别“只会三句词”的复读机命运,拥有独立记忆、情绪波动和完整人生,许诺让《上古卷轴 6》成为真正的第二人生(西部世界即将到来?)。

落差: 玩家很快发现,比起“人工智障”,一个“时空错乱且有人格分裂”的 AI 更能毁灭沉浸感。 由于 LLM 的不可控性,一位身处中世纪的骑士可能突然蹦出一句 2025 年的流行烂梗;上一秒誓死为你效忠的队友,下一秒因为 Token 上下文溢出,转头问“你是哪位”。 最讽刺的是“安全护栏”的矫枉过正:为了规避风险,厂商给 AI 加上了极重的道德枷锁。结果你在废土世界遇到的凶残劫匪,开口却是充满“非暴力沟通”和“包容性”的公关辞令,活像个穿越来的 HR BP。

不如会说“膝盖中了一箭”的NPC。

Image

多邻国 (AI 重构版)

期待: AI 赋能的“随身私教”,许诺用 AI 让外语学习更地道、更普惠,真正实现因材施教(成了就是 AI 普惠)。

落差: 裁掉人类专家换 AI,结果语料充斥着“机翻味”和逻辑幻觉。为了推销付费 AI 解析,官方竟然关掉了最宝贵的免费互助论坛,把“理解知识”变成了氪金特权。 真的 AI 普惠教育没做到,反而那只鸟不再关心你学会没有,只关心你的日活在不在。

Image

硅基立场播客

是的,我们自己的硅基立场播客,今年也是残次品状态。

期待:做成 AI 赛道最好的播客。

落差:要场景没场景、要氛围没氛围、要音质没音质、要画面没画面、要果盘没果盘,全靠主持人和嘉宾颜值撑着。

所以……敬请期待明年!

Image
图片