都市快报

杭州超越杭州!阿里深夜开源千问3,登顶全球最强开源模型,海外网友:我们正在见证一个全新时代的开始

在拥有全球最有影响力的三大开源模型之后,杭州再次超越杭州。
今天凌晨,阿里巴巴开源新一代通义千问模型Qwen3(简称千问3),参数量仅为DeepSeek-R1的1/3,成本大幅下降,性能则全面超越R1、OpenAI-o1等全球顶尖模型,登顶全球最强开源模型。
而就在一个月前,杭州三大开源模型包揽全球最大AI开源社区HuggingFace趋势榜榜单前三。
千问3宣布开源短短几个小时,获得了众多海外网友的点赞。有网友说:“中国刚刚超越了自己,成为开源人工智能领域第一大力量。我们正在见证一个全新时代的开始。”
Image
性能超越DeepSeek-R1和OpenAI-o1
千问3登顶全球最强开源模型

让海外网友大呼“难以置信”的千问3有多强?
简单来说,就是性能大幅提升,成本更低,在推理、指令跟随、智能体能力和多语言支持方面取得了突破性的进展。
千问3采用混合专家(MoE)架构,总参数量235B,激活只需要22B。千问3预训练数据量为36T ,并在后训练阶段多轮强化学习,将非思考模式无缝整合到思考模型中。
在推理、指令遵循、工具调用、多语言能力等方面大幅增强后,创下所有国产模型及全球开源模型的性能新高。
比如在奥数水平的AIME25测评中,千问3斩获81.5分,刷新开源纪录;在考察代码能力的LiveCodeBench评测中,千问3突破70分大关,表现甚至超过Grok3;在评估模型人类偏好对齐的ArenaHard测评中,以95.6分超越OpenAI-o1及DeepSeek-R1。
Image
千问3性能图
性能大幅提升的同时,千问3的部署成本则大幅下降。仅需4张H20即可部署千问3满血版,显存占用仅为性能相近模型的三分之一。
Image
国内首个“混合推理模型”
简单问题秒回 复杂问题“深度思考”
相对问题比较简单,低算力“秒回”答案,不用担心延迟卡顿;如果问题比较复杂,则通过多步骤“深度思考”。
和其他大模型不同的是,千问3是国内首个“混合推理模型”,“快思考”与“慢思考”集成进同一个模型。根据问题的复杂程度,API可以按需设置“思考预算”,进行不同程度的思考,大大节省了算力消耗。
千问3开源了6款稠密(Dense)模型,参数是0.6B, 1.7B, 4B, 8B, 14B, 32B;以及两款MoE模型,Qwen3-30B-A3B(30B总参数激活3B), Qwne3-235B-A22B(235B总参数激活22B)。每款模型都是同尺寸下的开源最佳性能(SOTA)。
Image
比如,4B模型是手机端的绝佳尺寸;8B可在电脑和汽车端侧丝滑部署应用;14B 模型适合作落地应用,普通开发者有几张卡也能玩转起来;32B最受企业大规模部署欢迎,有条件的开发者也可轻松上手。
两款MoE 模型中,旗舰235B-A22B模型仅激活很少参数就能获得极强性能,可以支持有一定资源基础的企业本地部署,整体上也非常适合云上部署使用;小一点的MoE模型30B-A3B 则适合对模型要求快速响应的应用(类似GPT 的mini 系列模型),速度快,效果佳。
事实上,设计和训练混合推理模型的难度,远超单纯的推理模型的。想象一下,训练混合推理模型,相当于模型要学习两种不同的输出分布,要做到两个模式融合且基本不影响任何一种模式下的效果,很考验训练过程的训练策略。
Image
非洲的斯瓦西里语都可以直接用
支持的语言和方言扩展到了119种
“根据我们内部的基准测评,Qwen2基础模型超越了目前市场上所有的闭源大语言模型”。这是一位名叫Nguyen Quan的越南工程师对千问2的评价。
在越南版MMLU测评中,无需微调的Qwen-72B模型取得了最佳成绩。Qwen迭代到1.5、2等更新版本,他也基于Qwen开发了越南语大模型。
在深度支持中、英、法、德、西、俄、日、韩、越、阿拉伯语等29种语言的基础上,千问3支持的语言和方言达到了恐怖的119种。
Image
其中,不但囊括了中、英、法、西、俄、阿拉伯等主要的联合国语言,还包含了德、意、日、韩、泰、越南、尼泊尔、瑞典、波兰、匈牙利等各国官方语言,此外,中国的粤语、非洲的斯瓦西里语、中东的意第绪语、西亚的亚美尼亚语、东南亚的爪哇语、美洲的海地语等地方性语言也不在话下。
这也意味着,低资源语言区(比如非洲的斯瓦西里语、中东的意第绪语等)的开发者,也可以借助大模型,直接使用或开发本地化工具,而不需要从零构建语言基础设施。同时,即使身处技术落后地区,没有持术能力开发自己语种的AI大模型的国家或地区,也能平等地体验AI大模型的强大能力。
Image
杭州超越杭州
海外网友:我们正在见证一个全新时代
就在千问3发布几个小时后,华为官方宣布昇腾支持千问3全系列模型部署,开发者在MindSpeed和MindIE中开箱即用。一天也没有耽搁,0天适配。
而苹果公司的深度学习负责人,也透露苹果手机和电脑第一时间对千问3系列模型进行了适配,并且为每一款硬件推荐了最匹配的千问3模型。
除了华为、苹果等终端厂商,NVIDIA、Intel、联发科、AMD等多家头部芯片厂商也已经火速成功适配千问3,在不同硬件平台和软件栈上的推理效率均显著提升,可以满足移动终端和数据中心场景的AI推理需求。
短短几个小时,海外社交平台上众多开发者和网友的评论像潮水一样涌来。
一位网友评论:当大家都在笑的时候,阿里打造了Qwen3,一个混合AI模型,在匹配和性能上超越了OpenAI和谷歌。
Image
也有网友说:中国刚刚超越了自己,成为开源人工智能领域的第一大力量。一年前,人们怀疑中国模型是否具有竞争力。
Image
有趣的是,这两天大洋彼岸的硅谷,Meta正在举行 LlamaCon 2025,即Meta 首个生成式AI开发者大会。一位海外网友在社交平台发布了一张替大会组织者流瀑布汗的照片。
Image
千问3的发布,全球AI界目光再次将聚焦到了杭州。眼下,杭州已经成为坐拥三大世界影响力开源大模型的城市,而这种你追我赶仍在继续。
今年1月至今,DeepSeek发布并开源了两款大模型,分别火到全球的DeepSeek-R1,以及DeepSeek-V3更新而来的0324版本。坊间传闻,DeepSeek-R2开源也已经进入倒计时。
大厂出身的通义千问的更新开源速度到了令海外开发者震惊的程度。1月至今,已经推出了近十款大模型,每次开源无一例外地将发布时间都选择了凌晨。
就在上个月,全球最大AI开源社区HuggingFace发布的最新趋势榜单,排在前三的三个大模型全部来自于杭州,除了通义千问Qwen2.5-Omni-7B和DeepSeek-V3-0324,还有一位新成员出自“杭州六小龙”群核科技发布的空间理解模型——群核SpatialLM。
当时杭州一举包揽了全球前三,被网友戏称:“在开源大模型领域,杭州正在’挑战’杭州。”
作为一家全球竞争力的AI科技公司,从2023年至今,阿里通义团队已开源200多款模型,通义千问Qwen在全球下载量超过3亿。目前,Qwen衍生模型数量已突破10万,超越美国Llama模型,成为全球第一AI开源模型。
在HuggingFace社区2024年全球模型下载量中千问Qwen占比超30%,稳居第一。在2025年2月的Huggingface全球开源大模型榜单(Open LLM Leaderboard)中,排名前十的开源模型全部都是基于千问Qwen二次开发的衍生模型。
“中美之间在顶级技术领域的差距已经非常小,几乎可以忽略不计。”今天,埃及前驻华大使马哈茂德·阿莱姆对点赞中国千问3大模型时说。
Image
今年4月份,斯坦福大学以人为本人工智能研究所(Stanford HAI)发布了《2025 年人工智能指数报告》。这份报告称,中美顶级AI大模型性能差距从2023年的两位数缩小至2024年近乎持平。
该报告显示,2024年重要大模型(Notable Models)中,阿里入选6个,按照模型贡献度排名,阿里AI贡献位列全球第三。

橙柿互动·都市快报 记者 沈积慧

审核 张倩 陈欣文