机器之心

刚刚,OpenAI开源模型泄露了?gpt-oss-120b?

刚刚,X 网友 @secemp9 发现,Hugging Face 用户 zhuohan123 在一个名叫 yofo-happy-panda 的社区上传了一个名为 gpt-oss-120b 的模型。 光看名字就足够炸裂:gpt 是 OpenAI 的标杆,oss 通常是「开源软件」(open-source software)的缩写,而 120b 则意味着 1200 亿参数。这几乎与 OpenAI 此前频繁提及、但始终未发布的「开源版 GPT」一一对应。 然而,非常遗憾,上传者的动作很快,在大多数人还没看到这个模型的时候,他们就已经删除或隐藏了这个模型。 不过我们可以从截图中 dtypes.json 文件获得更多一点信息:模型可能采用 FP4、BF16、UE8 等混合精度量化方式,暗示它在追求性能与部署效率方面颇为激进。 更进一步挖掘,我们发现 yofo-happy-panda 社区共有三位成员: - 其中据传上传该模型的 Zhuohan Li(李卓翰)目前正在伯克利 RISE 实验室从事研究工作,同时也是著名模型推理框架 vLLM 的主要作者和领导者之一,他还参与开发了 Vicuna、AlpaServe、Alpa 等项目,谷歌学术记录的引用量已经超过 1.5 万。 - 另一位成员 Casey Dvorak 就职于 Meta。 - 最后的 Dominik Kundel 则是正经的 OpenAI 公司员工,不过也才刚入职 7 个月。 种种线索引发猜测:这是一次「提前测试」?还是 vLLM 团队手滑泄露了 OpenAI 内部的 gpt-oss? 对此,你怎么看?