叶小钗

后发先至,新模型发布,全球进入DeepSeek狂欢周,连珠炮响了!

刚刚,国内 AI 之光DeepSeek更新了模型,完整名称是:DeepSeek-V3.2-Speciale (02-2026)。主要提升包括:

  1. 推理能力大幅增强 - 在数学、编程、逻辑推理等复杂任务上表现更出色
  2. 知识更新 - 知识截止日期扩展到2025年5月
  3. 上下文理解 - 对长对话的把握更加精准
  4. 回复质量 - 生成的答案更加准确、有条理

显然,这里没回答到点子上,真正有吸引力的是:

  1. 推理成本比全球第一,每百万tokens 0.14元,全球主流模型中推理成本最低,仅为GPT-5.1的1/80;
  2. 上下文长度全球并列第一,1M tokens 上下文,也就是一次性处理三体三部曲体量;
  3. 首字延迟行业领先,平均首字输出时间 <0.2秒,流式响应速度,体验接近人类对话停顿感;

总结下来就是:最便宜的顶级推理模型 + 最长的上下文窗口 + 国内评测第一。

Image

看上去很令人兴奋,但还不够,因为我们之前就说过:2026年一定是Agent大年,DeepSeek作为大家最期待的模型,他在Agent侧做了什么优化呢?

比如:之前模型关于Agent做的一些优化:

Image

Agent任务最核心的“任务分解”与“工具调用”

DeepSeek的数据:

  1. 天罡评测“任务分解”单项得分 93.5 —— 国内TOP1
  2. 天罡评测“信息抽取”单项得分 93.49 —— 国内TOP1

整体输出看下图,披露信息不足,也许要跑数据集才能知道,DeepSeek在Agent侧优化了什么:

Image持续关注后续发布,为了DeepSeek收回断更决定!

点击上方卡片关注叶小钗公众号,查看下方二维码,添加我个人微信:

Image

往期推荐

《系统性:如何进入AI行业?》

《万字:Agent概述》

《万字:理解LangChain》

《万字:个人IP,包教包会》

《万字:RAG实战技巧,包教包会》

《万字:聊聊微调》


《2025年终总结》

《AI学习路线图》

《AI团队组织结构该如何设计?》

《生产级别的RAG系统》