IT 邦德

被吹上天的国产大模型翻车了?

7月初,一场围绕华为盘古大模型的风暴席卷技术圈。一份由海外研究者发布的报告将华为推上风口浪尖:盘古Pro MoE模型被指“套壳”阿里通义千问,代码中惊现Qwen版权声明,模型参数相似度高达0.927?

华为诺亚方舟实验室随即发表声明,但质疑声仍未平息。面对“套壳、续训、洗水印”等指控,IT从业者该如何理性看待呢?中国大模型发展的真实图景又是怎样的?接下来小编给你们做一下详细的解读...

面对舆论风暴,华为诺亚方舟实验室在7月5日迅速发布官方声明,以专业态度直面质疑。

Image

1 华为官方声明

1.1 坚持自主创新

声明开宗明义:“盘古Pro MoE开源模型是基于昇腾硬件平台开发、训练的基础大模型,并非基于其他厂商模型增量训练而来。”华为特别强调其创新性地提出了分组混合专家模型(MoGE)架构,这是全球首个面向昇腾硬件平台设计的同规格混合专家模型,有效解决了大规模分布式训练的负载均衡难题。

1.2 尊重开源规范

对于代码中出现的阿里版权声明,华为坦然承认:“部分基础组件的代码实现参考了业界开源实践,涉及其他开源大模型的部分开源代码。”同时强调,“严格遵循开源许可证的要求,在开源代码文件中清晰标注开源代码的版权声明。这不仅是开源社区的通行做法,也符合业界倡导的开源协作精神。”

1.3 拥抱开放协作

声明结尾表达了开放态度:“我们始终坚持开放创新,尊重第三方知识产权,同时提倡包容、公平、开放、团结和可持续的开源理念。”华为欢迎开发者在官方社区就技术细节进行深入交流。

2.如何判断真伪

面对网络上的各种“实锤”和“声讨”,IT从业者需要专业视角进行理性的辨析

2.1 技术指标的科学性

引发争议的“0.927相似度”基于“LLM-Fingerprint”技术,通过比较模型注意力参数的标准差得出。但专业人士指出,当使用相同方法测试其他模型时,baichuan2-13b与Qwen1.5-14b的相似度也达0.87,baichuan2-13b与盘古-72b的相似度为0.84。这表明该指标可能缺乏足够的区分。

2.2 开源声明的合规性

代码中出现的“Copyright 2024 The Qwen team”声明,是Apache License 2.0协议下的标准合规做法。该协议允许自由使用、修改和分发开源代码,包括商业用途。保留原始版权声明恰恰体现了对开源规则的尊重,而非“抄袭证据”。

2.3 证据链的完整性

目前质疑方尚未公开完整的测试代码和方法论,最初的GitHub报告也已下线。HonestAGI团队表示将在完善后提交同行评审。在学术验证完成前,任何单一指标都不应成为最终判据。

Image

3 国内大模型生态

这场争议背后,折射出中国大模型生态的繁荣景象:

2025年,国内已形成多元化的开源大模型阵营——DeepSeek系列以超低训练成本实现全球全开源部署;阿里巴巴通义千问实现全模态支持;百川智能的Baichuan系列以开源免费吸引大量开发者;群核科技的空间理解模型为行业提供基础框架。

在这一生态中,华为盘古大模型展现出独特价值:作为首个面向昇腾硬件平台优化的同规格混合专家模型,已在30多个行业、400多个场景落地,从政务、金融到煤矿、气象领域发挥重要作用。

4.相信中国技术

当我们在键盘前质疑时,不应忽视这些事实:

华为盘古团队开创的MoGE架构,有效解决了大规模分布式训练的负载均衡难题;基于昇腾平台的深度优化,彰显了软硬件协同创新的技术实力;开源720亿参数模型,体现了推动行业进步的开放胸怀。

Image

在AI大模型领域,从零开始的“绝对原创”已成少数巨头的特权。正如DeepSeek等优秀开源模型的实践所示,站在巨人肩膀上创新是行业常态。关键在于是否尊重开源规则,是否在借鉴基础上实现真正的技术创新。

华为的快速回应展现了专业与担当——不回避问题,不推卸责任,以技术细节回应质疑,以开源精神拥抱监督。这种态度,正是中国科技企业成熟与自信的体现。

结语

开源世界的边界或许模糊,但创新的价值不会褪色,技术的付出终将被看见。当我们以专业眼光穿透舆论迷雾,终将发现:中国大模型的星空下,华为盘古依然闪耀着自主创新的光芒。

真相不会因质疑而褪色,真正的创新经得起任何审视。