浮之静

历史名场面:Anthropic & OpenAI 拒绝牵手

Sam Altman 和 Dario Amodei 在 2026 年德里 AI 影响峰会上拒绝牵手!

这主办方咋这没眼力见,真会安排 🤣!

关于 OpenAI 的瓜我之前写过不少(万字长文:OpenAI 发展史、没有员工,OpenAI 什么也不是!),但 Anthropic 似乎没咋写过,这次趁机聊点(在网上整理了一些评论)。

背景

创立动因

Anthropic 的创始团队(以 Dario Amodei、Daniela Amodei 等人为代表)从 OpenAI 出走并创办 Anthropic,核心动因通常被归结为三类:

  1. 安全与对齐优先(Safety & Alignment):他们认为强大 AI(AGI)的影响会在不远的将来到来,但现有的技术路径未必能把风险控制好。因此,他们决心将“安全与对齐”置于公司使命与工程机制的最高优先级,专注研发更可靠、可解释、可控的模型与治理框架。
  2. 路线与愿景的不可调和:媒体报道与当事人表述均指向,该团队与 OpenAI 在公司发展路线上出现了严重分歧。这主要体现在对“安全优先级”、“商业化部署节奏”以及“管理与领导方式”的理念冲突上。
  3. 独立的组织哲学:Dario Amodei 曾公开表示,与其在原机构里持续耗费心力争论别人的愿景,不如带着互相信任的同伴出来,从底层架构开始实现自己的愿景。

宪法 AI(CAI)

为了在技术层面实现其安全愿景,Anthropic 提出并应用了宪法 AI(CAI:Constitutional AI)。这套在 2022 年论文中确立的对齐训练范式(Constitutional AI: Harmlessness from AI Feedback[1]),旨在通过让模型遵循一组用自然语言写成的原则/规则(Constitution),进行自我监督与修正。其核心目标是在显著减少人工逐条标注的同时,更可控地塑造模型行为,尤其是提升“无害性(Harmlessness)”,并尽量避免简单粗暴的“回避式拒答(Evasive Refusal)”。

CAI 的标准训练流程包含两个关键阶段:

  1. 监督阶段(Supervised Learning / 自我批评与修正):模型针对提示词先生成一个初步回答,再依据“宪法”生成自我批评,并基于批评改写出更安全的答案。研究人员使用这些“改写后更符合宪法的答案”对模型进行监督微调(SFT)。
  2. 强化学习阶段(RLAIF / 基于 AI 反馈的强化学习):让模型对同一问题生成多个候选回答,再由模型(作为裁判)依据“宪法”进行偏好比较,从而训练出一个偏好/奖励模型(Reward Model)。最后,使用该奖励信号对主模型进行强化学习。

需特别澄清的是,“CAI 完全不需要人类反馈”是一种过度概括:

  • 人类反馈的混合使用:论文与工程的核心目标是让“无害性”的偏好信号尽量由 AI 自动化生成,但在实际系统(包括 Claude 系列模型)的训练中,Anthropic 仍混用人类反馈(RLHF)来提升模型的“有用性(Helpfulness)”与整体逻辑质量,并通过人类专家的红蓝对抗(Red-teaming)来验证最终效果。
  • “宪法”内容的演进:必须区分“研究阶段”与“产品阶段”的宪法。CAI 早期论文中的宪法是实验性的原则集合;而 Claude 产品的公开宪法/价值文档则是一个全面、动态的体系。Anthropic 明确指出其原则来源广泛,包括《世界人权宣言》、信任与安全最佳实践、DeepMind 的 Sparrow 原则以及对非西方视角的吸纳,并在 2026 年发布了大幅更新版的 Claude 宪法/价值文档(Claude’s Constitution[2]),引入了更深层的推理与价值权衡机制。

割裂感

Anthropic:牛逼的技术,在神经质般的操作下让人一脸懵逼...

从离开 OpenAI 到创办 Anthropic,一切似乎是在朝着愿景发展。但大规模封号,迫使 Clawdbot 更名、OAuth 权限收拢、似乎都在拒绝任何可能的开发生态(极度排外、傲慢)。也有技术大佬专门做过统计,证明这种“怪异”不是少部分人的感受。

Image

在文档中的 Claude Code OAuth 使用限制也让社区炸锅了,文档大意如下:

Claude Code 可用 OAuth 令牌或 API Key 认证,但用途严格区分:Free/Pro/Max 方案的 OAuth 仅限 Claude Code 与 Claude.ai,任何将这些 OAuth 令牌用于其他产品/工具/服务(包括 Agent SDK)的行为都被禁止并违反《消费者服务条款》;开发者若要构建调用 Claude 能力的产品或服务(含 Agent SDK),必须通过 Claude Console 或受支持的云厂商使用 API Key 认证,且 Anthropic 不允许第三方提供 Claude.ai 登录或代用户使用 Free/Pro/Max 凭证转发请求;Anthropic 可在不另行通知下采取措施执行上述限制,如需确认具体场景的合规认证方式请联系销售。

Image

这份文档乍看之下没有任何问题,但对消费者而言(尤其是 Max 计划订阅者),不可避免会想用 OAuth 授权做点别的事(如最近很火的 OpenClaw),官方至今没有给出具体回复。

Image

Anthropic 团队似乎是在刻意回避这个问题,我猜测原因可能有:

  • OpenAI 收购 OpenClaw 让 Anthropic 有点难受,这个用户量有点恐怖(OpenClaw 入编 OpenAI:开源不死,Agent 才刚开局)。
  • Codex 代码能力也在获得更多技术圈的认可,Claude Code 不可替代性在降低。
  • Anthropic 成本难以覆盖,Token 归根结底还是算力。收紧权限,防止薅羊毛本身没啥大问题,但一刀切有点说不过去,团队可能还在犹豫应该如何平衡成本和权限吧(回答不好这个问题,可能就要流失一大波用户)。
  • ...

本来是为了防止薅羊毛,制定的使用协议。如今却被被大量用户质疑:个人调用是否违规、接入 OpenClaw 是否违规...

Image

怕麻烦,ok 没问题,大家还贴心提供选项给到 Anthropic。已经简化到 “是/否、A/B”,也没收到任何回复...

Image
Image

Anthropic 这边迟迟没有回应,而 Codex 热情似火,对比之下,用户的心能不凉嘛...

Image

害怕你用不明白,OpenAI 还贴心的准备的接入文档 Codex App Server[3](虽然一直吐槽 Sam,但他是真的会做人啊,起码这波会收获不少用户),而且已公开表示通过 OAuth 方式接入 OpenClaw 是合法的:

Image
Image

Anthropic 发布的 MCP 协议(深度解析:Anthropic MCP 协议),大家基本都响应了,包括 OpenAI。但 OpenAI 牵头的 AGENTS.md 却迟迟得不到 Anthropic 的支持。先不论协议是否正确,Anthropic 连基本的表态都没有,就单纯不想和你们玩...

📌 小技巧

AGENTS.md 是一个开放的、基于 Markdown 的“智能体说明”约定,可以理解为给 AI 编码智能体看的 README。像 OpenAI Codex 这类工具会在开始工作前自动读取它:先读全局层(如 ~/.codex/AGENTS.md),再从项目根目录一路走到你当前目录逐级查找并拼接(从根到叶),越靠近当前目录的内容排在越后面,因此通常会“覆盖/优先生效”,并且有总大小上限。它不要求固定字段(“就是 Markdown”),常见写法是把能落地执行的内容写清楚:安装/启动/测试命令、代码风格与约束、目录结构与模块边界、安全注意事项、提交/PR 规范等;在 monorepo 里可以按子目录放嵌套 AGENTS.md,让“最近的文件优先”。

Image

AGENTS 虽支持不少智能体,但 Anthropic 死活不上套(不屑于和它们一起玩耍)。Thariq 表示会再把 AGENTS.md 方案拿出来和团队讨论,并强调“给 Claude 写提示词和其他模型不太一样(我在想是不是 “AI 宪法”的影响),所以最好让用户主动选择启用(opt-in)。把同一套提示词在所有模型之间共享会让表现略有下降”。

目前最简单做法:在你的 Claude.md 里用 @ 提及 Agents.md,这样就等于选择把 Agents.md 一并纳入 Claude 的上下文,同时你也可以在 Claude.md 里写一套专门针对 Claude 的独立指令。

Image

结语

吐槽归吐槽,Anthropic 在开发者中的能力口碑是不错的,但人品口碑就不咋滴了,大家根据自己的实际情况选择即可...

References

[1]

Constitutional AI: Harmlessness from AI Feedback:https://www.anthropic.com/research/constitutional-ai-harmlessness-from-ai-feedback

[2]

Claude’s Constitution:https://www.anthropic.com/constitution

[3]

Codex App Server:https://developers.openai.com/codex/app-server