DeepSeek-V4来了!
4月24日,DeepSeek 全新系列模型 DeepSeek-V4 预览版正式上线并同步开源。
百万字超长上下文、Agent能力大幅跃升、推理性能比肩顶级闭源模型—— 这一次,DeepSeek 再次刷新了开源模型的边界。
即日起,登录官网 chat.deepseek.com或官方 App,即可与最新的 DeepSeek-V4 对话,免费体验 1M(百万token)超长上下文的震撼能力。
API 服务也已同步更新,通过 model_name切换为 deepseek-v4-pro或 deepseek-v4-flash即可调用。
两个版本,两种定位
本次发布包含两款MoE模型:
DeepSeek-V4-Pro:总参数量 1.6 万亿,激活参数 490 亿,预训练数据量 33 万亿,主打高性能,对标世界顶级闭源模型。
DeepSeek-V4-Flash:总参数量 2840 亿,激活参数 130 亿,预训练数据量 32 万亿,主打轻量高效,极致性价比。
两者均原生支持 1M 上下文,并同时提供 非思考模式与 思考模式(支持 reasoning_effort参数)。
DeepSeek-V4-Pro:开源阵营的新王
Agent 能力大幅提高
相比前代,DeepSeek-V4-Pro 的 Agent 能力实现了质的飞跃:
在 Agentic Coding评测中,达到当前开源模型最佳水平
公司内部已将其作为主力 Agentic Coding 模型使用
评测反馈:使用体验优于 Sonnet 4.5,交付质量接近 Opus 4.6 非思考模式
编程与推理:多项榜单登顶
在多个权威基准测试中,DeepSeek-V4-Pro-Max 取得了领先或比肩顶级闭源模型的成绩:
Codeforces:得分 3206,超越 GPT-5.4(3168)和 Gemini 3.1 Pro(3052),位列全场最高。
LiveCodeBench:得分 93.5,同样是全场最高。
SWE Verified:得分 80.6,微弱落后于 Opus 4.6(80.8)。
MMLU-Pro:得分 91.0%,与 GPT-5.4 相当,与 Gemini 3.1 Pro(91.0%)持平。
GPQA Diamond:得分 90.1%,Gemini 3.1 Pro 为 94.3%。
AIME 2026:得分 99.4%,展现出顶级的数学推理能力。
HumanEval:得分 90%,代码生成准确率表现优异。
在编程和数学推理领域,DeepSeek-V4-Pro 已站稳全球第一梯队。
🌍 世界知识:开源最强,逼近闭源
大幅领先所有其他开源模型
仅稍逊于顶尖闭源模型 Gemini-Pro-3.1
具体来看:GPQA Diamond 90.1 分(Gemini 94.3),HLE 37.7 分(Gemini 44.4),SimpleQA-Verified 57.9 分(Gemini 75.6)。
整体而言,开源与闭源的差距已缩小到 3~6 个月,这在一年前几乎不可想象。
DeepSeek-V4-Flash:经济高效的不二之选
世界知识储备略低于 Pro 版,但推理能力接近
参数更小、激活更少,API 服务更快、更便宜
Agent 场景下,简单任务表现旗鼓相当,高难度任务仍有差距
如果你追求极致性价比或高频调用,Flash 版本就是答案。
结构创新:百万上下文不再是“奢侈品”
DeepSeek-V4 开创了一种全新的注意力机制:
Token 维度动态压缩
DSA 稀疏注意力(DeepSeek Sparse Attention)
效果惊人:
在 1M 上下文下,V4-Pro 的单 token 推理计算量仅为 V3.2 的 27%,KV Cache 占用降至 10%
V4-Flash 更是压缩到 10% 和 7%
从现在开始,1M 上下文是 DeepSeek 所有官方服务的标配。
此外,V4 还引入了:
流形约束超连接(mHC):提升信号传播稳定性
Muon 优化器:训练收敛更快、更稳定
MoE 结构:每层 384 个专家,每次激活 6 个
Agent 能力专项优化
DeepSeek-V4 针对主流 Agent 产品进行了深度适配与优化:
Claude Code
OpenClaw
OpenCode
CodeBuddy
在代码任务、文档生成、工具调用等场景下表现均有显著提升。
从“能聊”到“能做”,DeepSeek-V4 正在重新定义开源模型的生产力边界。
API 访问
Base URL 不变,只需修改
model参数deepseek-v4-pro/deepseek-v4-flash支持 OpenAI ChatCompletions 接口与 Anthropic 接口
最大上下文:1M token
支持 思考模式(
reasoning_effort:high / max)
⚠️ 注意:旧模型名 deepseek-chat与 deepseek-reasoner将于 2026-07-24停止使用。
当前阶段,它们分别指向 deepseek-v4-flash的非思考模式与思考模式。
价格:还是那个“价格屠夫”
DeepSeek-V4-Flash:
缓存命中输入 0.2元 / 1M tokens,缓存未命中输入 1元 / 1M tokens,输出 2元 / 1M tokens。DeepSeek-V4-Pro:
缓存命中输入 1元 / 1M tokens,缓存未命中输入 12元 / 1M tokens,输出 24元 / 1M tokens。
横向对比:Flash 的输入价格约为 Claude Opus 4.6 的 1/50,GPT-5.4 的 1/27;输出价格比 Claude 便宜 68 倍,比 GPT-5.4 便宜 27 倍。
注:Pro 版因高端算力受限,当前吞吐较有限。预计下半年昇腾 950 超节点批量上市后,价格将大幅下调。
国产算力:里程碑式适配
这一次,DeepSeek-V4 从设计之初就深度适配 华为昇腾等国产算力底座。
华为计算官方宣布:昇腾超节点全系列已全面支持 DeepSeek-V4
工程师完成从 CUDA 生态向 华为 CANN 架构的底层迁移
据评测,在华为昇腾 950 上算力利用率约 85%,部署成本仅为英伟达方案的 1/3
这标志着中国 AI 产业在 去 CUDA 化进程中迈出了关键一步。
市场反应同样热烈:发布当天,GPU 指数盘中直线拉升,海光信息大涨超 9%,寒武纪、龙芯中科等纷纷跟涨。
“模型 — 芯片 — 云” 的国产闭环,正在逐步跑通。
写在最后:开源模型的分水岭
如果把 DeepSeek-V4 放到更大的图景中,它的意义远不止一次版本更新:
推理能力:已对齐顶级闭源水平
世界知识:仅稍逊一筹,开源最强
Agent 能力:已接近高端闭源模型的部分形态
差距当然还在,尤其是在深度思考和极难知识上。
但差距正在以远超预期的速度缩小。
当大多数公司将大模型封闭为黑箱时,DeepSeek 选择开源、选择透明、选择让世界看到底层逻辑。
正如他们在发布中所写的那句古语:
“不诱于誉,不恐于诽,率道而行,端然正己。”
唯一的问题是:这种开源的理念和国产化的路径,在商业与地缘政治的双重挤压下,还能承载多大的重量?
至少在今天,答案依然是——
前行。
元宇宙与人工智能三十人论坛
因微信公众号整改,没有加“星标⭐️ ”的订阅号有时无法收到消息
1.为防止错过最新资讯,请将元宇宙与人工智能三十人论坛设为星标⭐️
2.点击“赞”和“在看”,提高我们相遇的几率。
3.精彩文章,请点击文末左下角“分享”给好友。
了解更多关注