资讯

DeepSeek V4.1 Flash 模型上线国家超算互联网

IT之家·2026/9/10 11:47:00🔗 原文

📋总体概括

9月10日,DeepSeek V4.1 Flash 模型正式上线国家超算互联网中心,用户可通过官网「模型服务」页面调用其 API。该模型为552B参数的MoE架构,采用全新Causal-Encoder-Decoder结构,输入激活仅8B、输出激活16B,成本显著低于同尺寸模型。新模型经全新预训练和更大规模强化学习后训练,基准测试超越包括DeepSeek V4 Pro在内的旗舰模型。同时大幅压缩KV Cache,HBM需求降至上一代1/4、SSD需求降至1/8,显著降低推理部署门槛,对Agent场景成本优化意义突出。

关键信息

  • DeepSeek V4.1 Flash 于9月10日上线国家超算互联网中心,官网「模型服务」页面可直接调用API
  • 模型为552B参数MoE架构,采用Causal-Encoder-Decoder新结构,输入激活8B、输出激活16B,成本低于同尺寸模型
  • 经新预训练方式与更大规模强化学习后训练,基准测试超越DeepSeek V4 Pro等旗舰模型
  • KV Cache大幅压缩:HBM需求降至上代1/4,SSD需求降至1/8,降低部署硬件门槛
  • Agent场景中缓存命中费用占比较高,该优化直击长上下文应用的推理成本痛点

🔥犀利点评

这波操作的精髓不在跑分超越自家V4 Pro,而在把HBM需求砍到1/4、SSD砍到1/8——在显存贵如金的当下,这等于把旗舰智能塞进了平民硬件里。上超算互联网更是意味深长:官方算力渠道铺路,摆明了要吃政企和信创市场。Flash这个后缀向来是轻量定位,却干翻旗舰,DeepSeek的架构效率牌越打越凶,友商的参数堆料叙事该紧张了。

本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文