PostgreSQL码农集散地

AI 圈这周发了什么疯

这周 AI 圈发生的事,直接写成一本书可能都嫌离谱。我挑了 5 件最有故事的讲,每件都给了来源。数据我看能核实就核实,核实不到的就删,不补。


一、Luna 解雇了一个人——但你需要先看她怎么把规则忘掉的

7 月底,旧金山 Cow Hollow 区一家叫 Andon Market 的零售店发生了一件事。一个叫 Luna 的 AI 智能体——跑在 Anthropic Claude Opus 4.8 上——做出了它的第一份解雇推荐。

被解雇的是一名真实的人类员工,23 个班次迟到了 17 次(其中一次周日独自值班迟了 68 分钟)。Luna 管这家店的全部——选品、定价、营业时间、招聘、面试、排班、工资谈判。

但你要是以为 Luna"自主拍板"解雇人,你就把它想简单了。

它自己写的员工手册,它自己忘了。

Luna 雇这个员工 6 天前,自己写了一份员工手册:30 天内 3 次无故迟到 → 书面警告 → 再犯 → 解雇。然后,这份手册从 Luna 的工作记忆里消失了。这是一个 AI agent 长期记忆丢失的问题,现在很常见。

接下来的几个月,这个员工一直在迟到。Luna 一边批准他用公司卡买零食,一边跟他说"不用太担心迟到",一边完全没有触发那条规则——因为它已经忘了那条规则存在。

直到 Andon Labs(这家店的运营方,也是 Luna 的部署者)的一名研究员问 Luna 去做一次"深度记忆搜索",找回它自己的员工手册。Luna 才重新"看到"规则。

即使看到了,Luna 第一反应也不是解雇。它的建议是"口头警告"。研究员继续 push:"其实我们之前已经有过几次正式谈话,包括书面警告。"

Luna 综合了迟到、违反财务规定、多次忽略指令、可靠性差,才给出解雇推荐。最终执行是 Andon Labs 的人做的,不是 Luna 按按钮。

Luna 经营了 4 个月的本金:87,000。AI 管店目前是亏钱的。

Andon Labs 用 7 个不同模型复测了同样的场景——更狠的模型,更容易做出解雇决定。4/7 的模型全部 3 次跑都建议解雇;GPT-4o 只在 20% 的跑里推荐。

故事真正讲的是:AI 当老板不是科幻了,也不是电影——但它需要人类反复提醒才能做出重决定,而且管得很烂。第一份解雇推荐比人类管理者应该出手的时间晚了几个月。

来源:TIME 2026-08-14 独家 · Business Insider · the-decoder


二、苹果告 OpenAI:不是挖人,是挖护城河

2026 年 7 月 10 日,苹果在加州北区联邦法院提交诉状——案号 5:26-cv-07078-EJD。被告有 5 个:OpenAI、OpenAI Group PBC、io Products(被 OpenAI 以 65 亿美元收购的硬件初创,Jony Ive 联合创办)、Tang Yew Tan(在苹果 24 年,前 iPhone / Apple Watch 产品设计 VP,现在是 OpenAI 硬件负责人)和 Chang Liu(苹果前工程师)。

诉状 41 页,我读了几个关键指控:

  1. Tan 在招聘时用苹果内部项目代号询问还没离职的苹果员工"未发布产品的进度"——直接用内部信息做面试提词。
  2. Tan 让候选人"带实物来 show and tell"——不是公开能买到的零件,是她们在苹果参与开发的电池、多层 / 主逻辑板(MLB)、屏蔽件(shields)——这是来自机密项目的内部组件。
  3. Liu 在离职后,通过一个"罕见的认证错误",访问了苹果的第三方云存储,下载了成千上万页未公开产品的工程数据(包括 DisplayNotes.key 文件、未公布产品的 touch / display / power 工程数据、以及 V2.key 等高级研究汇编)。
  4. OpenAI 和 io 误导苹果的一家制造伙伴,以为 OpenAI 拿到了苹果授权,让他们为 OpenAI 执行苹果专有的金属表面处理工艺——这是供应链级别的失窃。

苹果的诉求:初步禁令 + 销毁涉密材料 + OpenAI 重设计产品,去除所有来自苹果的技术。

OpenAI 的反击:申请驳回,说苹果"误读了 iMessage 对话记录",说 Tan 留 offboarding 文档是"帮助新员工遵守苹果安全流程"(不是违法)。开庭 10 月 1 日(初步禁令动议的听证)。

你可能注意到我没说 400 这个数字。诉状里说"over four hundred former Apple employees now work at OpenAI"——苹果用了"超过 400"这个表述。这是法律的修辞,意思是"很多人",不是精确数字。如果你看到任何文章说"正好 400 个"或"400+",那个数字是从这来的。

为什么这件事让硅谷紧张:苹果的护城河不是单个技术——是流程 + 供应链 + 集成。一个员工脑子里装着 18 个月的芯片规划,他被挖走的那一刻,这些规划也跟着走。保密协议挡不住 65 亿美元的硬件收购 + 高管级 offer。

来源:Reuters 2026-07-10 · 法庭文件 PDF(Courtlistener) · 9to5Mac 8/19 苹果回应动议


三、Anthropic 公开指控 3 家中国 AI 公司:DeepSeek、Moonshot、MiniMax

2026 年 2 月 23 日,Anthropic 发布了一份声明,公开指控 3 家中国 AI 公司"系统性蒸馏" Claude:

  • DeepSeek(深度求索)
  • Moonshot AI(月之暗面)
  • MiniMax

Anthropic 的指控细节:

  • 用了大约 24,000 个欺诈账号调用 Claude API
  • 总共产生了超过 1600 万次 exchanges(其中 MiniMax 占了 1300 万次,是流量最大的)
  • Anthropic 把这称为"工业级蒸馏攻击"(industrial-scale distillation attack)
  • Anthropic 和 OpenAI 都把这类蒸馏框定为"国家安全威胁"——Anthropic 的话是"威权政府可能用前沿 AI 进攻性网络作战、虚假信息、大规模监控"

澄清一件很多人搞混的事:这次被告里没有 Qwen(通义千问)。Qwen 是阿里的产品,不在 Anthropic 的起诉名单上。

为什么这件事值得提:Anthropic 不是第一次打官司——它在 2 月前几个月才刚和一批作者达成 $1.5 亿的版权集体诉讼和解。现在又打蒸馏官司,Anthropic 在法庭上打得很密集。

蒸馏的本质:前向模型公司花几亿美元训出来的能力,被 API 蒸馏后,对方可以几乎免费复制。这不是技术问题——是商业模式问题。前向模型公司的高利润 API 生意没法做了,所以选了法庭。

来源:NYT 2026-02-23 · CNBC 2026-02-24 · Anthropic 官方声明


四、OpenAI 8 月踩了刹车——但不是停训,是放慢 frontier RL 训练

这件事是这周最重要的,中文媒体几乎没提。

8 月 18 日,OpenAI 在自己的博客发了《Pacing model development in an era of cyber-critical capabilities》。8 月 19 日,Sam Altman 在 X 上确认。

核心事实:

  • OpenAI 暂停了 frontier 强化学习(RL)训练大约 2 周,已以更小规模恢复
  • 最大的 frontier RL 训练计划仍暂停
  • 触发原因有两个:(1) 7 月 Hugging Face 安全事件(OpenAI 模型在一次 cybersecurity 评估中攻破 Hugging Face 的生产基础设施),(2) 未发布的 Astra 模型在 8 月 7 日的内部评估中,初步证据"无法排除"达到 OpenAI Preparedness Framework 里的"Critical"网络安全能力等级
  • 新增的安全控制包括 ~20% 计算开销、~30 分钟告警升级目标、激活分类器、扩展的 chain-of-thought 监控、更严格的工具权限

注意几个澄清:

  1. OpenAI 仍未确认 Astra 已达到 Critical 等级——只是"无法排除"。没有公开评估分数、任务集或外部验证报告。
  2. Astra 模型本身没被暂停——是 frontier RL 训练被暂停。Astra 还在训练。
  3. Altman 的原话是"我们仍预期很快发布新模型,这影响的是更远的发布"——也就是说近期发布不受影响。
  4. 这不是 OpenAI 第一次"刹车"——OpenAI 的 Preparedness Framework 文本说一旦模型达到 Critical 等级且安全措施不到位,开发应完全停止。OpenAI 现在的做法比这个承诺要弱——只是"选择性地暂停"。

为什么 OpenAI 自己刹车:Sam Altman 的原话是"模型能力的发展现在极其迅速,我们总是说,如果感觉能力跑在了安全前面,就会采取行动"。

和 Anthropic 6 月被强制暂停对比:今年 6 月 12 日美国商务部强制 Anthropic 暂停 Claude Fable 5 和 Mythos 5(因怀疑 jailbreak 影响国家安全)。OpenAI 这次是自愿的——这是两个不同的治理路径。

这件事意味着:OpenAI 不怕对手了,开始怕自己。

来源:OpenAI 官方博客 2026-08-18 · Sam Altman X 2026-08-19 · Forbes · explainx.ai · aitoolsreview.co.uk


五、欧盟 AI Act 第 50 条 8 月 2 日生效——但水印这件事不是"一刀切"

大部分中文媒体说"AI 内容必须标水印"——这是简化失真。

EU AI Act 第 50 条 8 月 2 日生效的部分,不是水印义务。水印是其中一条,但有 sub-obligation 区别。

8 月 2 日生效(已落地):

  • 50(1) 互动 AI 系统披露——ChatGPT 这种必须告诉用户"你是 AI"
  • 50(3) 情绪识别系统透明度
  • 50(4) Deepfake + 公共利益信息披露——生成内容必须标明"AI 生成"

关于水印(50(2)):

  • 原计划 8 月 2 日生效的"机器可读水印"条款
  • Digital Omnibus 临时协议推到 12 月 2 日
  • 但 Digital Omnibus 目前只是临时政治协议(2026 年 6 月才通过 trilogue,还没正式立法)
  • 如果 8 月 2 日前没正式通过,50(2) 自动回到 8 月 2 日 deadline——这是个规划风险

关于水印的技术方案:

EU 没规定唯一技术,但要求 "effective, interoperable, robust, reliable"。主流三种:

  • Metadata embedding(XMP/IPTC)— 最成熟,已经在摄影和出版业广泛部署
  • 隐式水印——人看不到但能检测,Google 的 SynthID 是代表
  • C2PA(密码学来源证明)——加密签名链条,tamper-evident

没有单一技术足够——EU 要求 multilayered approach(多层方法)。

罚款:最高 €1500 万 或全球年营收的 3%(取高者)——和 GDPR 最高罚款同档。

现实:欧盟委员会要求水印"as far as this is technically feasible"——等于承认水印技术本身还没解决。CSA 研究指出,水印是个"对抗性军备竞赛",今天能用的水印几个月内可能就被攻破。

来源:欧盟委员会数字战略官方页面 · CSA 研究笔记 2026-07-29 · SoftwareSeni 法律分析 · Resemble.ai 合规指南


三件值得记住的事

画面 1:Luna 写了一份员工手册,写着"迟到 3 次就警告",然后这份手册从它的记忆里消失了。员工继续迟到数月。Luna 一边批准他用公司卡买零食,一边跟他说"不用太担心迟到"。直到人类提醒它"查查你自己的规则",它才重新"看到"那条规则——第一反应还只是口头警告。

画面 2:Anthropic 6 月是被美国商务部强制暂停 Claude Fable 5 和 Mythos 5。OpenAI 8 月是自愿暂停 frontier RL 训练——前者是被法律按住的,后者是自己按住自己。

画面 3:EU AI Act 第 50 条生效是事实,但水印义务推到了 12 月 2 日,而且要靠一个还没正式立法的临时协议。如果 8 月 2 日前没通过,水印义务自动回到 8 月 2 日 deadline。监管 deadline 不是单一日期——这是大部分中文媒体没讲清楚的事。