alitrack

余承东的字典里没有「第二」—— HDC 2026 揭开华为 AI 帝国的四层闭环

「在我余生的字典里,没有第二,只有第一。」

6 月 12 日,东莞松山湖。余承东站在 HDC 2026 的舞台上,用这句话为华为的 AI 路线图定调。

但更值得玩味的是他接下来的坦白:「AI 算力现在非常紧缺。我自己留的算力很有限。」

一个声称要拿第一的人,同时承认手里弹药不足。这不是示弱——这是亮剑。

三天演讲、数十项发布,拆开来看,华为正在布一个覆盖芯片、模型、系统、终端的四层棋局。每一层都不是孤立的。


section

section

昇腾芯片现在有多抢手?

华为计划 2026 年生产约 75 万颗昇腾 950PR 芯片,仍远不能满足市场需求。中国移动深圳算力平台一个单子就砸了 1.55 亿元采购昇腾 910C。国产算力芯片自给率预计 2027 年达到 82%。

data

data

这不是华为主动选择的饥饿营销。三重因素叠加:

首先,美国的制裁意外加速了替代。 2025 年 4 月 NVIDIA H20 被禁售,虽然仅三个月后就恢复,但这段真空期让国内企业集体转向。黄仁勋在 Computex 2025 上承认,英伟达在中国 AI 芯片的份额「已经大幅下降」。

其次,美国 BIS 在 2025 年 5 月进一步扩大了对昇腾的全球管辖——任何使用昇腾 910B/C/D 的企业都可能违反美国出口管制。这反而坐实了昇腾的「战略物资」地位,国内需求集中爆发。

第三,DeepSeek V4 等国产模型的突破,让推理算力需求井喷。 模型能力上来了,算力缺口更大了。

余承东的选择很务实:不追万亿参数,死磕推理效率。openPangu 2.0 的 505B MoE 架构仅激活 18B 参数,单卡吞吐率达到业界主流开源模型的 2 倍,时延低 1.2 倍。

你不给我 NVIDIA,我就把昇腾上的效率做到你的两倍。

section

section

HDC 2026 最大的炸弹,是 openPangu 2.0 的完全开源。

版本总参数激活参数上下文定位
**Pro**505B18B512K政企旗舰
**Flash**92B6B512K端侧/私有化

六大核心能力全覆盖:长文本法律金融、全栈代码工程、数学逻辑推理、多轮 Agent 工具调用、中文公文写作、低算力稀疏推理——无明显短板。

从 6 月 30 日起,七大组件陆续全开源:

  1. 01MoE 架构预训练完整源码
  2. 02SFT 微调 + RLHF 后训练代码
  3. 03昇腾专用训练/推理算子库
  4. 04DSA+SWA 稀疏注意力模块
  5. 05512K 上下文缓存脚本
  6. 06INT4/INT8 量化部署工具
  7. 07鸿蒙端侧轻量化适配工程

strategy

strategy

这七件套不只是开源,是一套完整的「昇腾税」征收体系。

复盘一下逻辑链条:

  • 模型免费 → 开发者蜂拥而至 → 生态基数扩大
  • 昇腾深度优化 → 最佳性能只能在昇腾上跑 → 你跑得好就必须买昇腾
  • 鸿蒙端侧 30B 模型进麒麟芯片 → 手机厂商预装鸿蒙 → 终端锁定
  • 企业级部署 → 华为云昇腾实例 → 持续的云服务收入

这跟当年 Android 的逻辑一模一样:AOSP 开源免费,但 Google Mobile Services 和 Play 商店收费。openPangu 是 AOSP,昇腾算力云就是 GMS。

区别在于:Google 只能用软件锁定,华为还能用芯片锁定。这是 Android 当年想做但没做到的。


section

section

「鸿蒙将成为首个完成 AI 化改造的操作系统。」

余承东这句话不是夸张。HarmonyOS 7 的核心变化,不是多加了一个 AI 助手入口——而是 Harmony Intelligence 向 Agent 架构全面演进。

compare

compare

什么意思?

过去的 AI 助手是你打开一个 App,对它说话,它帮你做一件事。鸿蒙 7 的小艺不一样:

  • 拥有 200 多项系统级数据权限
  • 能跨应用、跨设备理解你的意图
  • 你说「帮我制定一个半马训练计划」,它自己去查赛事信息、读你的健康数据、翻日历,生成计划写进日程
  • 你说「把电脑上跟物理实验相关的资料发到我手机」,即使电脑合盖待机也能完成

现场演示了更激进的能力:小艺 CLOUD 智能体。用户用自然语言说「做一个儿童学英语的工具,支持拍物体学单词」,小艺自动生成一个具备拍照识别、英文发音和释义的轻应用。

何刚的原话:「这等于让每个消费者都成为开发者。」

comparison

comparison

就在同一周,苹果在 WWDC 2026 上也发布了强化端侧 AI 的新系统。两条路线开始分化:

  • 苹果:隐私优先,端侧计算为主,封闭生态
  • 华为:跨设备协同,端-边-云统一调度,开源拓展

操作系统 AI 化的竞赛,已经从功能点升级为体系战。

鸿蒙生态设备已突破 13 亿台,小艺日活 1.8 亿。13 亿台设备就是 13 亿个 Agent 入口。


section

section

把昇腾芯片、盘古模型、鸿蒙系统、终端设备串起来看,华为在构建的是一张 AI 时代的完整版图:

芯片层(昇腾950PR/910C/鲲鹏)→ 算力底座
    ↓
模型层(openPangu 2.0 + 盘古5.5)→ 智能引擎
    ↓
系统层(HarmonyOS 7 + 小艺Agent)→ 智能体平台
    ↓
终端层(手机/车/IoT/PC 共13亿台)→ 用户入口

arch

arch

这张图的厉害之处在于每一层都为上下层创造锁定效应:

昇腾芯片为盘古模型提供最优推理效率(2x)→ 开发者用盘古就绑定了昇腾 → 盘古深度集成鸿蒙 Agent → 鸿蒙驱动终端设备 → 终端设备卖得越多,昇腾算力需求越大。

这是一个自我强化的飞轮。

这套打法在 PC 时代叫「Wintel 联盟」——Intel 的芯片 + Windows 的系统,统治了个人计算二十年。华为这次要做的是 AI 时代的 Wintel,区别在于:芯片、操作系统、大模型、终端品牌,全是自己的。


section

section

按照确定性从高到低:

第一梯队(确定性最高):昇腾算力链上游

昇腾芯片产能扩张直接拉动晶圆代工(中芯国际 N+2/N+3 工艺)、先进封测(长电科技、通富微电 COOS 封装)、ABF 载板(兴森科技,70% 产能供昇腾)、高速连接器(华丰科技 224G 连接器市占 70%+)。

第二梯队:国产芯片替代链

昆仑芯 P800、寒武纪思元 590、摩尔线程 MTT S80 等,在 NVIDIA 真空期拿到了大量订单。

第三梯队:鸿蒙生态应用

政企民生应用正在加速鸿蒙化——「粤省事」法人版已上线智能体功能,开源鸿蒙覆盖电鸿、工鸿、水鸿等 20 多个行业。

一个关键认知:投资昇腾链不是投资华为(华为不上市),而是投资华为的供应商。昇腾芯片卖得越好,上游国产供应链越受益。


section

section

第一问:开源模型真的有护城河吗?

Android 开源的护城河是 GMS——没有 GMS 的手机在中国以外几乎卖不动。openPangu 的护城河是昇腾芯片的亲和优化。但如果 NVIDIA 恢复供货,或者国产替代芯片(昆仑芯、寒武纪)也做了盘古适配,这个护城河还牢固吗?

第二问:75 万颗昇腾够用吗?

75 万颗 950PR + 910C 的产能,对比 NVIDIA H100/H200 全球出货量,差距仍然巨大。如果国产模型训练和推理需求继续以当前速度增长,算力缺口可能不降反升。

第三问:美国制裁会不会再升级?

BIS 2025 年 5 月的指南已经将管辖权延伸到「使用昇腾芯片」的非中国企业,违者最高罚 20 年监禁。如果制裁进一步限制昇腾的代工制造环节,整个四层闭环的底座将面临直接威胁。


一句话总结:华为用「开源模型免费获客 → 昇腾算力收费变现 → 鸿蒙 Agent 锁定终端」的三级火箭,构建了一个 AI 时代自给自足的商业闭环。而余承东说「字典里没有第二」时,他真正的底气不是某一个大模型,而是这个别人复制不了的四层体系。


本文基于 HDC 2026(6月12-14日)余承东主题演讲、华为官方发布、公开研报及一手信源交叉验证。