DeepSeek 不再不差钱,V4 睁眼
DeepSeek 不再「不差钱」:融了 500 亿,V4 终于睁开眼睛了
2026 年 6 月,DeepSeek 同时做了两件事:拿下 500 亿人民币的外部融资,以及让它的模型「睁开眼睛」——支持视觉。这件事标志着中国 AI 创业史的一个分水岭。
别人家大模型公司急着要外部资本,也不需要对任何投资人解释为什么这个季度没有进一步进展。
这套逻辑在 2025 年 1 月还成立。美股科技股灾之后,媒体对这家公司的印象逐渐固化:「不差钱」。
今年 6 月,这个印象碎了。
「不差钱」的人,来了 500 亿
2026 年 6 月初,The Information 率先曝出:DeepSeek 正在进行新一轮融资,目标估值 520 亿至 590 亿美元。投资方包括腾讯、大基金(中国集成电路产业投资基金),以及若干中东主权基金。
两周后消息坐实——融资完成,总额约 74 亿美元(约 500 亿人民币)。
这是全球 AI 领域 2026 年最大的一笔融资之一。在「AI 泡沫论」甚嚣尘上的背景下,这个数字本身就是一个信号。
一份「万国来朝」的投资人名单
和大多数 AI 初创公司的投资人结构不同,DeepSeek 这一轮的出资方阵容堪称「国家队+产业资本+国际主权基金」的三层结构:
- 腾讯:领投方。腾讯云已经是 DeepSeek 的推理服务提供商之一。腾讯需要 DeepSeek 的模型能力来对抗阿里+通义千问的组合。
- 大基金(中国集成电路产业投资基金):这是大基金首次投资 AI 大模型公司。作为国家芯片战略的资本工具,大基金的进入意味着 AI 大模型已经被提升到「国家基础设施」的高度。
- 中东主权基金:包括阿布扎比的 Mubadala、卡塔尔投资局(QIA)等。中东资本在 2025 年全球 AI 投资中占比超过 30%,它们需要在中国 AI 赛道下注。
这不是一轮普通的 VC 融资——这是一个 「国家意志 + 平台生态 + 国际资本」的联盟。
钱过门了,钥匙还在谁手里
但这轮融资有一个非常特殊的结构:外部投资人没有投票权。
根据 The Information 的报道,DeepSeek 创始人梁文锋保留了完全控制权。外部投资人拿的是纯财务股份——可以分钱,但不能指手画脚。
这在全球 AI 融资史上极为罕见。OpenAI 拿了微软 130 亿美元,Anthropic 拿了 Google 20 亿美元——都有董事会席位或战略约束。DeepSeek 拿得更多,但条件更「硬」。
原因是 DeepSeek 确实有这个底气:它在 2025 年用自己的利润养活了整个研发团队,没有外部股东可以拿「断粮」来要挟。
不差钱的人要钱,不是因为缺钱——是因为要做更大的事。
为什么偏偏是现在?
有三个因素聚在一起:
1. 算力军备竞赛升级。 2025 年 DeepSeek V3 证明了 MoE(混合专家)架构可以用更少的算力达到 GPT-4 级别的性能。但 2026 年 V4 的训练规模远超 V3,需要的算力呈指数增长。美国芯片出口管制正在收紧,DeepSeek 需要提前囤积足够的算力资源。
2. Agent 时代来了,API 要扩容。 Codex、Claude Code、Cursor 等编程 Agent 工具正在把数百万开发者变成「API 重度用户」。DeepSeek 的 API 调用量在过去半年增长了 300% 以上。要承载这个规模,基础设施投入不能省。
3. 视觉能力需要新基础设施。 V4 的多模态能力——尤其是视觉理解——对推理基础设施的要求远超纯文本模型。这不是「加几台服务器」的问题,是需要从芯片到数据中心的全链路扩容。
V4 终于「睁开眼睛」了——这意味着什么
2026 年 6 月,DeepSeek 发布了 V4 的视觉能力预览版。模型现在支持图像输入——用户可以上传截图、图表、照片,DeepSeek 能理解图像内容并做出回应。
技术上,V4 的视觉能力基于原生多模态架构,不是「在文本模型上外挂一个图像编码器」的后期拼装。这意味着视觉和文本推理在同一个表示空间中协同工作。
官方公布了几个关键指标:
- 在 90 个 KV(Key Visual)基准测试上达到世界顶级水平
- 视觉推理成本仅为 Claude Opus 的 1/10
- 支持 1M token 的超长上下文,图像和文本共享上下文窗口
- 三种模式:Fast(快速)、Expert(专家)、Vision(视觉)可灵活切换
但有一个重要的前置条件:目前 V4 的视觉能力只在网页端和 App 可用。API 暂不支持图像输入。
这意味着开发者还无法通过 API 让 DeepSeek V4 分析图像。想要在编程 Agent 中使用视觉能力的开发者,需要等 API 开放——或者,用接下来要介绍的方式。
Moon Bridge:V4 的 API 还看不见?这座桥让它看见
前面说了 V4 支持视觉——但 API 不支持图像输入,这是一个巨大的缺口。你没法把一张截图发给 DeepSeek API 让它分析。
这个缺口,Moon Bridge 填上了。
Moon Bridge 是一个 Go 语言编写的开源 API 协议代理。它的核心定位是:让 Codex、Claude Code 等编程 Agent 无缝接入 DeepSeek。但它最特别的地方,是一个内置的视觉扩展。
视觉扩展的工作原理:当 Codex 或 Claude Code 发送截图、架构图、UI 设计稿时,Moon Bridge 自动调用 Qwen VL 模型将图像转成文字描述,再注入到 DeepSeek 的 API 请求中。DeepSeek V4 看到的不是像素,是文字转述——但效果出奇地好。代理侧的智能让模型不需要原生多模态也能「理解」图像内容。
一桥接三端:
- Codex(OpenAI 官方编程 Agent)→ 通过 Moon Bridge 路由到 DeepSeek V4
- Claude Code(Anthropic 编程 Agent)→ 直接走 Anthropic 协议到 DeepSeek
- 任意 OpenAI 兼容客户端 → Chat Completions 路径,零改动接入
除了视觉桥接,Moon Bridge 还提供了插件系统(工具注入、请求改写、会话录制、技能注入)、双协议架构(Anthropic / OpenAI Chat 各自独立 provider,保持流式 SSE 原生效率),以及完整的 Admin API 用于运行时管理。
一句话:DeepSeek V4 的 API 还看不见图,Moon Bridge 让它看见。 成本只有 Claude Opus 的十分之一。
🔗 GitHub: github.com/alitrack/moon-bridge — MIT 协议,Go 单二进制部署
关于 Moon Bridge 的架构设计、视觉扩展原理和实际部署,可参阅此前发布的深度介绍:《Moon Bridge:一桥接三端》
DeepSeek 的故事,开始从「实验室」走向「国家队」。V4 Vision 的 90 个 KV 编码,也许是它进入下一个时代的坐标点。
而 Moon Bridge 的存在意味着:你不需要等 API 开放,现在就可以让 DeepSeek V4 在你的编程工作流中「看见」一切。
参考来源:The Information, Reuters, SCMP, 36氪, 证券时报, IT之家, TechNode, MindStudio, BestHub, DeepSeek GitHub, DeepSeek API Docs