刚刚,国内 AI 之光DeepSeek更新了模型,完整名称是:DeepSeek-V3.2-Speciale (02-2026)。主要提升包括:
推理能力大幅增强 - 在数学、编程、逻辑推理等复杂任务上表现更出色 知识更新 - 知识截止日期扩展到2025年5月 上下文理解 - 对长对话的把握更加精准 回复质量 - 生成的答案更加准确、有条理
显然,这里没回答到点子上,真正有吸引力的是:
推理成本比全球第一,每百万tokens 0.14元,全球主流模型中推理成本最低,仅为GPT-5.1的1/80; 上下文长度全球并列第一,1M tokens 上下文,也就是一次性处理三体三部曲体量; 首字延迟行业领先,平均首字输出时间 <0.2秒,流式响应速度,体验接近人类对话停顿感;
总结下来就是:最便宜的顶级推理模型 + 最长的上下文窗口 + 国内评测第一。
看上去很令人兴奋,但还不够,因为我们之前就说过:2026年一定是Agent大年,DeepSeek作为大家最期待的模型,他在Agent侧做了什么优化呢?
比如:之前模型关于Agent做的一些优化:
Agent任务最核心的“任务分解”与“工具调用”
DeepSeek的数据:
天罡评测“任务分解”单项得分 93.5 —— 国内TOP1 天罡评测“信息抽取”单项得分 93.49 —— 国内TOP1
整体输出看下图,披露信息不足,也许要跑数据集才能知道,DeepSeek在Agent侧优化了什么:
