资讯
DeepSeek V4.1 Flash 模型上线国家超算互联网
📋总体概括
9月10日,DeepSeek V4.1 Flash 模型正式上线国家超算互联网中心,用户可通过官网「模型服务」页面调用其 API。该模型为552B参数的MoE架构,采用全新Causal-Encoder-Decoder结构,输入激活仅8B、输出激活16B,成本显著低于同尺寸模型。新模型经全新预训练和更大规模强化学习后训练,基准测试超越包括DeepSeek V4 Pro在内的旗舰模型。同时大幅压缩KV Cache,HBM需求降至上一代1/4、SSD需求降至1/8,显著降低推理部署门槛,对Agent场景成本优化意义突出。
⚡关键信息
- ▸DeepSeek V4.1 Flash 于9月10日上线国家超算互联网中心,官网「模型服务」页面可直接调用API
- ▸模型为552B参数MoE架构,采用Causal-Encoder-Decoder新结构,输入激活8B、输出激活16B,成本低于同尺寸模型
- ▸经新预训练方式与更大规模强化学习后训练,基准测试超越DeepSeek V4 Pro等旗舰模型
- ▸KV Cache大幅压缩:HBM需求降至上代1/4,SSD需求降至1/8,降低部署硬件门槛
- ▸Agent场景中缓存命中费用占比较高,该优化直击长上下文应用的推理成本痛点
🔥犀利点评
这波操作的精髓不在跑分超越自家V4 Pro,而在把HBM需求砍到1/4、SSD砍到1/8——在显存贵如金的当下,这等于把旗舰智能塞进了平民硬件里。上超算互联网更是意味深长:官方算力渠道铺路,摆明了要吃政企和信创市场。Flash这个后缀向来是轻量定位,却干翻旗舰,DeepSeek的架构效率牌越打越凶,友商的参数堆料叙事该紧张了。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →