Claude Mythos官宣!性能碾压Opus 4.6贵5倍,因太危险遭「囚禁」
Jay 发自 凹非寺
量子位 | 公众号 QbitAI
猛兽要出
笼了
。
就在刚刚,Anthropic那个被传得神乎其神的最强模型——
Claude Mythos
,释放出了预览版。
- SWE-bench Pro: 修bug能力,暴涨24%
- SWE-bench Verified: 拿严格版又测了一遍,仍有13%的提升。
- Terminal-Bench 2.0: 电脑操作类Agent能力,提升17%。
Mythos Preview已经发现了数千个高危漏洞,各大主流操作系统和浏览器,无一幸免。没错,在AI编程能力飞速提升,越来越像一名称职工程师的同时,与之一体两面的另一项能力,也在无可避免地野蛮生长。 现在, Mythos攻击安全漏洞的能力,已经远超绝大多数黑客了。
AI 在代码层面的能力已经强到,在找漏洞和利用漏洞这件事上,可以超过绝大多数人类工程师,只剩最顶尖的一小撮还能与之抗衡。硬币的另一面,终于翻到了我们面前。 Anthropic表示,照现在AI的发展速度,这种能力很快就会扩散开来,甚至可能被那些不那么安全的人掌握。 一旦失控,对经济、公共安全来说, 都将是灭顶之灾。 为了给所有人留下足够的时间来应对,在首次官宣这个新模型时,Anthropic做出了一项对于AI公司来说,非常反常的举动。 暂时不向公众开放。 是的,Mythos会作为 玻璃翼计划 (Project Glasswing)的一部分,先向各个合作伙伴开放。
被囚禁的Claude Mythos
这是一场声势浩大的「围剿」。 为了驯服Mythos这头猛兽,Anthropic几乎叫上了所有老牌互联网巨头。 参与方包括: Amazon、Apple、Google、Linux Foundation、Microsoft、NVIDIA…… 在这个项目里,没有旁观者。所有合作方都会把Mythos Preview投入到自身的防御性安全工作中。 他们会提前解锁Mythos的真实能力,将它从笼子里放出来。 这是一次提前训练。 在被Mythos正式版捅成筛子之前 ,他们会尽可能利用Mythos预览版的能力,加强自己的防御措施。 安全这件事,这次,是动真格的。 Anthropic称会把过程中积累的经验分享出来,让整个行业都能受益。 项目还额外开放给了40多家关键软件基础设施的建设者和维护者,让他们用这个模型去扫描和加固自研系统以及开源系统。 更夸张的是,Anthropic还承诺 提 供最高 1亿 美元 的使用额度来支持这些工作,甚至直接向开源安全组织捐赠了 400万美元 。猛兽出笼了
Token usage烧的飞快,Pro用户「降级」成免费用户,OpenClaw被断水断粮,Claude Code莫名其妙的开源…… 一切,似乎都有了理由。 Anthropic可能真忙晕头了。 Mythos的安全问题,已经严重到让团队内部无心关注其他项目,只得押上自己手中所有的GPU,全部押注到安全上来。 因为—— 猛兽,要出笼了。 参考链接:[1]https://x.com/alexalbert__/status/2041579938537775160?s=46&t=iTysI4vQLQqCNJjSmBODPw
[2]https://www.anthropic.com/glasswing 一键三连 「点赞」「转发」「小心心」 欢迎在评论区留下你的想法! — 完 —
🔹 谁会代表2026年的AI? 龙虾爆火,带动一波Agent与衍生产品浪潮。
但真正值得长期关注的AI公司和产品,或许不止于此。 如果你正在做,或见证着这些变化,欢迎申报。
让更多人看见你。 👉 https://wj.qq.com/s2/25829730/09xz/