Qwen 三连发,直接把开源打成了主场秀!
Qwen 来了个三连发。几个月没见的卡皮坤(Qwen),肌肉又大一圈了,训练痕迹肉眼可见,着实把我惊到了。 之前我说阿里是“最早从工程走向产品的中国大模型团队”,这周我得再升个级:它已经开始定义开源 AI 的“发布节奏”和“产品标准”了。 这周三连发,几乎把开源模型的三大高地都重新封顶了一遍: 1️⃣ Qwen3-235B-A22B-Instruct-2507:超越 Claude 4(Non-thinking)。权威研究机构 Artificial Analysis 直接下结论:“千问3是全球最智能的非思考基础模型。” 2️⃣ Qwen3-Coder:在多语言评估里超 GPT-4.1、Claude 4,还登上了 HuggingFace 模型总榜冠军。命令行工具 Qwen Code 也同步亮相,明显奔着“开发者默认工作流组件”去的。 3️⃣ Qwen3-235B-A22B-Thinking-2507:支持 256K 上下文,直接对齐 Gemini 2.5 Pro、o4-mini,把“开源推理模型”这个段位拉到了闭源顶尖的门口。 这不是“某一款模型能不能打”的问题,阿里直接来了一次体系化爆发:基础模型、编程模型、推理模型“三位一体”,背后还有云平台、推理链、Agent 工具包、社区发布节奏的全栈式协同。 开源不止是“代码扔出来”,而是“production-ready 的开放产品”,而阿里,真的做到了。 别忘了,阿里已经开源 300+ 通义模型、衍生模型 14 万个,成为全球第一的开源模型家族;还宣布 未来三年再投 3800 亿元搞云和 AI 基建。这意味着它并没有盯着短期刷一波榜,他的长期野心是把“从模型到基础设施的确定性”全都押上去了。 你再看另一边:美国顶流模型几乎集体收口闭源:GPT-4 不开、Gemini 收口、Claude 限 API。反而是阿里,用“开源 + 工程化 + 基建”三件套,把开源做成了国际级的可用性标准。 这场牌已经不是“中国有没有实力”的命题了。阿里站在世界擂台的正中央,开始定义节奏本身。 想起那句话:“The GOAT doesn’t announce itself. It just keeps dropping.” 现在,是阿里在 drop,也在 flex💪。