OpenAI 推出两款新的开放权重模型,让你在飞机上也能编程
邮箱|[email protected]
https://every.to/vibe-check/vibe-check-openai-drops-two-new-open-weight-models
如果你的人生梦想是能在荒岛、停电的林间小屋,或是没有 WiFi 的长途航班上 “随性编码”,那欢呼吧!梦想成真了。
近两日,OpenAI 发布了自 2019 年 GPT-2 以来的首批开放权重模型:gpt-oss-120b 和 gpt-oss-20b。这两款开源模型让用户可以在自己的笔记本电脑或者是私人云服务器上运行,而不是依靠OpenAI 提供的 API 为用户服务。随着这两款开源模型的推出,用户可以随时随地利用 AI 进行编码,哪怕是远离人群的林间小屋或者是没有WIFI的4万英尺高空。
其中gpt-oss-20b 是一个非常小的版本,小到可以在 MacBook 上运行。在编码和其他推理任务上,它的性能大致与 o3-mini 相当。我再强调一下:你现在可以在 MacBook 上运行一个达到 o3-mini 水平的模型。
而120b 是更强大的模型,它被设计用于在私人云端的单个 GPU 上运行。根据 OpenAI 的内部基准测试,在竞赛编程、一般问题解决和工具调用等推理任务上,它达到或超过了 o4-mini。
通常我喜欢亲身体验这些产品的性能,但不幸的是,在这些模型发布前我没能尝试它们。不过,根据 OpenAI 的内部基准测试,这两款模型似乎都在其尺寸的其他开放模型中突破了当前的前沿,比如 Meta 的 Llama 和阿里巴巴的 Qwen。正如 OpenAI 联合创始人兼总裁格雷格・布罗克曼昨日在与记者的通话中所说:“整个团队在这个项目上全力以赴。”
这两款模型都已在 Apache 2.0 开源软件许可证下免费发布,因此用户可以自行使用、修改或出售它们。
关键问题是:这些模型有什么用?为什么发布它们?背后的策略是什么?
这些模型有什么用?
这个问题我能马上想到好几个答案,而现在我们也开始测试OSS模型在不同场景的使用效果。
但最值得一提的是,OSS系列的发布解决了部分公司的“安全问题”。很多公司都有为对冲基金和私募股权公司服务的咨询业务,而这些公司受到严格的隐私和安全法规约束。而oss的开源会立即引起这些企业的兴趣,因为它们现在可以在自己的数据中心安全地运行这些模型。
虽然有很多开放权重模型可以免费使用,但大多数企业已经与 OpenAI 签订了 ChatGPT 的企业合同。以前,它们可能想要使用像 Kimi K2 或 Qwen 这样的开放权重模型,但对于有严格监管和合规要求的公司来说,试图在其安全的私有云端安装违背允许的A模型是件会让 IT 主管极为头疼的事情。而OpenAI 的 oss 系列模型拥有同样的开放权重灵活性和安全优势,且没有地缘政治方面的问题。
其次,不少公司有一套 Mac 应用程序,可以利用这些模型提供具有更好安全性和隐私性的 AI 功能。我们的 AI 文件管理器 Sparkle 会将你的文件名发送到 OpenAI 的云端 —— 这对注重安全的用户来说是不可接受的。同样,我们正在测试版中的 AI 听写应用 Monologue也会将你的听写 transcript 发送到云端进行处理。
我们已经为这两款应用尝试过设备端处理(Monologue 使用设备端的 Whisper 进行转录)。不过目前来看,其速度和可靠性还不足以发布。
未来几周我们将对这些模型进行全面测试,并分享我们的测试结果。
我们梳理了目前Google官方报告和参与内测的用户的反馈,以及Genie3背后团队的深度访谈,为大家提供核心信息的汇总,更好了解这个模型。
作为生态系统一部分的“开放权重”规则
OpenAI 的开放权重模型有一个巧妙之处,即它们使用与云端模型相同的 API 和提示格式。你为 OpenAI 模型构建的任何内容都能在这些新的本地模型上无缝运行,而你在本地构建的任何内容也能无需修改就迁移到云端。
开放权重现在是 AI 生态系统的核心部分,云端和设备端使用之间的界限正在迅速模糊。特别是随着像 Qwen 和 Kimi K2 这样高质量开源模型的兴起,大多数客户都希望有这两种选择。通过发布能直接接入其现有 API 的开放权重模型,无论客户在哪里或以何种方式运行模型,OpenAI 都能将他们留在自己的生态系统中。
这就是为什么他们像奥普拉(Oprah)一样,开始为每个人提供免费模型。
开放权重是 OpenAI 实现无处不在的方式 —— 在笔记本电脑和私有云端都能使用,同时让那些客户实际付费的更大型前沿模型,只需一行代码就能调用。
你现在可以在 HuggingFace 上下载它们,阅读 OpenAI 的博客文章,或加入我们的 Discord 进行讨论。