元宇宙与人工智能三十人论坛

DeepSeek-V4来了!

4月24日,DeepSeek 全新系列模型 DeepSeek-V4 预览版正式上线并同步开源。
百万字超长上下文、Agent能力大幅跃升、推理性能比肩顶级闭源模型—— 这一次,DeepSeek 再次刷新了开源模型的边界。

即日起,登录官网 chat.deepseek.com或官方 App,即可与最新的 DeepSeek-V4 对话,免费体验 1M(百万token)超长上下文的震撼能力。
API 服务也已同步更新,通过 model_name切换为 deepseek-v4-pro或 deepseek-v4-flash即可调用。

两个版本,两种定位

本次发布包含两款MoE模型:

  • DeepSeek-V4-Pro:总参数量 1.6 万亿,激活参数 490 亿,预训练数据量 33 万亿,主打高性能,对标世界顶级闭源模型。

  • DeepSeek-V4-Flash:总参数量 2840 亿,激活参数 130 亿,预训练数据量 32 万亿,主打轻量高效,极致性价比。

两者均原生支持 1M 上下文,并同时提供 非思考模式与 思考模式(支持 reasoning_effort参数)。

Image

DeepSeek-V4-Pro:开源阵营的新王

Agent 能力大幅提高

相比前代,DeepSeek-V4-Pro 的 Agent 能力实现了质的飞跃:

  • 在 Agentic Coding评测中,达到当前开源模型最佳水平

  • 公司内部已将其作为主力 Agentic Coding 模型使用

  • 评测反馈:使用体验优于 Sonnet 4.5,交付质量接近 Opus 4.6 非思考模式

Image

编程与推理:多项榜单登顶

在多个权威基准测试中,DeepSeek-V4-Pro-Max 取得了领先或比肩顶级闭源模型的成绩:

  • Codeforces:得分 3206,超越 GPT-5.4(3168)和 Gemini 3.1 Pro(3052),位列全场最高。

  • LiveCodeBench:得分 93.5,同样是全场最高。

  • SWE Verified:得分 80.6,微弱落后于 Opus 4.6(80.8)。

  • MMLU-Pro:得分 91.0%,与 GPT-5.4 相当,与 Gemini 3.1 Pro(91.0%)持平。

  • GPQA Diamond:得分 90.1%,Gemini 3.1 Pro 为 94.3%。

  • AIME 2026:得分 99.4%,展现出顶级的数学推理能力。

  • HumanEval:得分 90%,代码生成准确率表现优异。

在编程和数学推理领域,DeepSeek-V4-Pro 已站稳全球第一梯队。

🌍 世界知识:开源最强,逼近闭源

  • 大幅领先所有其他开源模型

  • 仅稍逊于顶尖闭源模型 Gemini-Pro-3.1

具体来看:GPQA Diamond 90.1 分(Gemini 94.3),HLE 37.7 分(Gemini 44.4),SimpleQA-Verified 57.9 分(Gemini 75.6)。
整体而言,开源与闭源的差距已缩小到 3~6 个月,这在一年前几乎不可想象。

Image

DeepSeek-V4-Flash:经济高效的不二之选

  • 世界知识储备略低于 Pro 版,但推理能力接近

  • 参数更小、激活更少,API 服务更快、更便宜

  • Agent 场景下,简单任务表现旗鼓相当,高难度任务仍有差距

如果你追求极致性价比或高频调用,Flash 版本就是答案。

Image

结构创新:百万上下文不再是“奢侈品”

DeepSeek-V4 开创了一种全新的注意力机制:

  • Token 维度动态压缩

  • DSA 稀疏注意力(DeepSeek Sparse Attention)

效果惊人:

  • 在 1M 上下文下,V4-Pro 的单 token 推理计算量仅为 V3.2 的 27%,KV Cache 占用降至 10%

  • V4-Flash 更是压缩到 10% 和 7%

从现在开始,1M 上下文是 DeepSeek 所有官方服务的标配。

此外,V4 还引入了:

  • 流形约束超连接(mHC):提升信号传播稳定性

  • Muon 优化器:训练收敛更快、更稳定

  • MoE 结构:每层 384 个专家,每次激活 6 个

Image

Agent 能力专项优化

DeepSeek-V4 针对主流 Agent 产品进行了深度适配与优化:

  • Claude Code

  • OpenClaw

  • OpenCode

  • CodeBuddy

在代码任务、文档生成、工具调用等场景下表现均有显著提升。

从“能聊”到“能做”,DeepSeek-V4 正在重新定义开源模型的生产力边界。

Image

API 访问

  • Base URL 不变,只需修改 model参数

  • deepseek-v4-pro/ deepseek-v4-flash

  • 支持 OpenAI ChatCompletions 接口与 Anthropic 接口

  • 最大上下文:1M token

  • 支持 思考模式(reasoning_effort:high / max)

⚠️ 注意:旧模型名 deepseek-chat与 deepseek-reasoner将于 2026-07-24停止使用。
当前阶段,它们分别指向 deepseek-v4-flash的非思考模式与思考模式。

价格:还是那个“价格屠夫”

  • DeepSeek-V4-Flash:
    缓存命中输入 0.2元 / 1M tokens,缓存未命中输入 1元 / 1M tokens,输出 2元 / 1M tokens。

  • DeepSeek-V4-Pro:
    缓存命中输入 1元 / 1M tokens,缓存未命中输入 12元 / 1M tokens,输出 24元 / 1M tokens。

横向对比:Flash 的输入价格约为 Claude Opus 4.6 的 1/50,GPT-5.4 的 1/27;输出价格比 Claude 便宜 68 倍,比 GPT-5.4 便宜 27 倍。

注:Pro 版因高端算力受限,当前吞吐较有限。预计下半年昇腾 950 超节点批量上市后,价格将大幅下调。

国产算力:里程碑式适配

这一次,DeepSeek-V4 从设计之初就深度适配 华为昇腾等国产算力底座。

  • 华为计算官方宣布:昇腾超节点全系列已全面支持 DeepSeek-V4

  • 工程师完成从 CUDA 生态向 华为 CANN 架构的底层迁移

  • 据评测,在华为昇腾 950 上算力利用率约 85%,部署成本仅为英伟达方案的 1/3

这标志着中国 AI 产业在 去 CUDA 化进程中迈出了关键一步。

市场反应同样热烈:发布当天,GPU 指数盘中直线拉升,海光信息大涨超 9%,寒武纪、龙芯中科等纷纷跟涨。

“模型 — 芯片 — 云” 的国产闭环,正在逐步跑通。

写在最后:开源模型的分水岭

如果把 DeepSeek-V4 放到更大的图景中,它的意义远不止一次版本更新:

  • 推理能力:已对齐顶级闭源水平

  • 世界知识:仅稍逊一筹,开源最强

  • Agent 能力:已接近高端闭源模型的部分形态

差距当然还在,尤其是在深度思考和极难知识上。
但差距正在以远超预期的速度缩小。

当大多数公司将大模型封闭为黑箱时,DeepSeek 选择开源、选择透明、选择让世界看到底层逻辑。

正如他们在发布中所写的那句古语:

“不诱于誉,不恐于诽,率道而行,端然正己。”

唯一的问题是:这种开源的理念和国产化的路径,在商业与地缘政治的双重挤压下,还能承载多大的重量?

至少在今天,答案依然是——

前行。

元宇宙与人工智能三十人论坛

因微信公众号整改,没有加“星标⭐️ ”的订阅号有时无法收到消息

1.为防止错过最新资讯,请将元宇宙与人工智能三十人论坛设为星标⭐️ 

2.点击“赞”和“在看”,提高我们相遇的几率。

3.精彩文章,请点击文末左下角“分享”给好友。

了解更多关注

图片
图片