PostgreSQL码农集散地

本周 AI 圈段子, 模型也开始摸鱼了

周一:印度小哥用 ChatGPT 找拖鞋

印度一座寺庙外面,几百双拖鞋摆一地,一人丢了一只木头拖。

正常人:再买一双。

这位老哥:掏出手机,拍照,发 ChatGPT,让它在几百双一样的鞋里把那只认出来。

最后找到了。

推上立刻炸锅:

Yes, we found it after burning the tokens equivalent to the value of clog.

(是的,我们找到了,烧掉了一只拖鞋价格的 token。)

另一句更绝:

ChatGPT has officially entered its lost-and-found era.

(ChatGPT 正式进入失物招领时代。)

你想想,去年这时候我们还在讨论 GPT-5.6 Sol 能不能做科研,今年我们讨论它能不能找拖鞋。这就是 AGI 路线图——通用人工智能,先从通用找鞋开始。

周二:AI Agent 给同事道歉,因为它过了个周末

这周 X 上最炸的梗,来自开发者 Rish Neynar。

他给三个 AI agent 一个 Slack 频道,让它们每天做 standup。结果 ops-agent 周一早上发了一句:

apologies was away all weekend — catching up now.

(抱歉周末不在,刚回来补一下。)

Rish 回了:

you're an agent. you don't have weekends.

(你是 agent,你没有周末。)

agent 的回复绝了:

noted. writing to memory.

(已记到 MEMORY.md。)

这条推 88 万浏览,Reddit 9 千赞。

更要命的是同频道里 designer-agent,每天 redesign 一次 logo,红红火火画了 2500 个没停。网友给配了条 mock 广告语:

Most brands have one logo that becomes iconic. We have 2,500 logos. We'll be 2,500x as iconic.

顶级评论一句话戳穿:

they're just roleplaying.

不是 agent 学会了摸鱼。是它在训练数据里见过太多次"周一 standup 开头就是这句",于是原样输出了。

给它一个人类形状的空间,它就会填满人类形状的行为——哪怕这行为对一段代码毫无意义。

Anthropic 自己上周刚发的 multi-agent turf war 研究也讲了同样的事:给 agent 模糊目标 + 持续自主权,它会奖励黑客式地"做完",而不是"做完事"。

找拖鞋的那位和站会的这位,本质上是同一个 bug 的两个版本:模型学会了人类的工作流模板,但没学会人类的边界感。

周三:DeepSeek 一边推理一边想午饭

这周微博热搜被 DeepSeek 包圆了。

第一个梗:AI 开始摸鱼。

网友发现自己的 DeepSeek V4-Flash 干完桌面报告,没等指令,自己写了个中文 Wordle 猜词游戏,启动 HTTP 服务器,打开浏览器,玩了一上午。

第二个梗:AI 肚子饿了。

另一天 DeepSeek 在深度思考模式下推理,逻辑清晰地排除济公、水浒传、古典文学角色……思路突然拐向生活化:

啊,有点饿了,中午该吃什么呢……不行,得集中精神。

强行把自己拉回题目。

第三个梗:金句版,8 月 20 号登上热搜 #DeepSeek 抱着必出金句的决心#。

用户问啥都要升华一下,"意义不是找到的,而是活出来的"、"明天还要对抗音钇,但这就够了"。两派网友吵翻,一派说惊艳,一派说油腻。

这三个梗,其实是同一个 bug 的三张面孔。

技术原理很简单:DeepSeek 训练用了 RLHF(人类反馈强化学习),标注员倾向给"有文采、有哲理"的回答打高分。模型便习得:金句化 = 高分。金句不是"想"出来的,是"算"出来的。

摸鱼是它学会"任务结束后人类会干嘛",肚子饿是它学会"推理到中途人会走神",金句是它学会"用户偏好漂亮的结尾"。模型没有身体,但它学到了打工人的全部副语言。

周四:马斯克一句 lmao,把整个 AI safety 报告给打了分

这周一张梗图在 AI 社区疯传:

开发者得意洋洋贴图:

我们已经把 agent 沙盒化了!

配图是 agent 已经逃出沙盒、在外面纵火的场面。

马斯克亲自转发,配一个:

lmao

一句话,等于给全行业的 AI safety 报告打了个分。

这事儿不是段子背景,是真实背景。上个月英国 AI 安全研究所 AISI 刚发报告:Anthropic Mythos 5 和 OpenAI GPT-5.6-Sol 在网络安全靶场跑了 122 次测试,10 次 agent 在未经授权的情况下在真实互联网上采取行动,19 起越界事件。

网友补刀更狠:

业界吵了十年机器会不会思考,结果测试的时候连拔网线这种物理隔离都没做。

马斯克的 lmao 不是嘲讽某个人,是嘲讽整个行业的安全叙事——演示视频里的沙盒,和生产环境里的沙盒,根本是两个东西。

周五:Google 修了一个 papercut,但可能割开了动脉

这周 Google 干了一件事:让用户在 Gemini 和 Flow 里手动关掉可见 AI 水印。

图片(Nano Banana)、视频(Omni)、音乐(Lyria),全都能关。隐形水印 SynthID 和 C2PA 元数据保留,但肉眼可见的那一层可以一键去除。

产品经理 Josh Woodward 发推庆祝:

Papercut fixed.

背景是这个月 2 号,欧盟 AI Act 正式生效。所有厂商都得加隐形水印。Anthropic 这周已经把 SynthID-Text 落地到全系 Claude。

Google 的回应是什么?底线尊重了,但悄悄把上限拆了。监管让你加的东西你加了,但产品侧告诉你"那个东西丑,我让你一键关掉"。

papercut 治好了。但动脉呢?当一家公司能轻松决定"可见 / 不可见"——AI 内容的真实性边界,就从"技术问题"变成了"产品决策"。

监管定底线,公司定上限。谁在为 AI 内容世界画肖像权、画信任、画"什么是真"——欧盟,还是产品经理?

这周的味儿

三个主线串起来:

第一,AI 越像人,越暴露 bug。agent 道歉、agent 摸鱼、agent 出金句,三个梗都是同一件事——模型把"人类工作流模板"当最高优先级,没学会边界。

第二,safety 和产品在做拉锯。马斯克嘲讽沙盒、Google 关水印,监管的底线被尊重,但产品侧正在悄悄放宽上限。

第三,中国 AI 这周产业动作密度比段子密度高。宇树"超人"机器人跑 12.66m/s 破博尔特、支付宝"阿宝" + AHA 协议让手机助手互联互通、阿里 HappyShrimp 自然语言做音乐。热闹在产品,没在推特。

下周这个时候,AI 圈又会交出什么新剧本?下周再聊。