产业观察
DeepSeek V3.2 正式版发布,V4 还没来,但已经是开源模型里 Agent 能力最强了
📋总体概括
DeepSeek 于12月1日发布 V3.2 正式版,包含 DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale 两个版本。V3.2 在9月底实验版 V3.2-Exp 基础上迭代,核心是引入 DeepSeek Sparse Attention(DSA)稀疏注意力技术,提升长文本处理效率,并重点强化推理与 Agent 能力。Speciale 版作为开源模型,在 IMO 2025、CMO 2025 等基准上性能媲美 Gemini-3.0-Pro。此前 DeepSeek 还发布了基于 V3.2-Exp-Base 的数学模型 DeepSeek-Math-V2,达到 IMO 金牌
⚡关键信息
- ▸DeepSeek 发布 V3.2 正式版,含 DeepSeek-V3.2 与 DeepSeek-V3.2-Speciale 两个版本,重点提升推理和 Agent 能力
- ▸V3.2 引入 DeepSeek Sparse Attention(DSA)稀疏注意力技术,基于9月底的 V3.2-Exp 实验版迭代,大幅提升长文本处理效率
- ▸开源的 V3.2-Speciale 在 IMO 2025、CMO 2025 等推理基准上性能媲美 Gemini-3.0-Pro
- ▸前几天发布的 DeepSeek-Math-V2 基于 V3.2-Exp-Base 开发,达到 IMO 金牌级数学水平
- ▸DeepSeek 在 V4 尚未发布前继续迭代 V3 系列,自称已是开源模型中 Agent 能力最强
🔥犀利点评
别被「正式版」三个字迷惑,这本质是 V4 前的一次挤牙膏式榨干——但 DeepSeek 榨得确实有水平。DSA 稀疏注意力解决的是长文本推理成本这个真痛点,而 Speciale 敢拿开源模型对标 Gemini-3.0-Pro,说明闭源领先窗口正在快速收窄。更狠的是打法:先用 Exp 版当底座孵化 Math-V2 拿金牌背书,再顺势推 V3.2,一鱼两吃。开源阵营里 Agent 能力这块,DeepSeek 已经不给对手留时间了。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 极客公园 阅读全文 →