资讯

DeepSeek官宣flash系列模型降价 最高直降60%

驱动之家·2026/9/9 01:32:00🔗 原文

📋总体概括

DeepSeek开放平台公告,自2026年9月10日12:00起下调flash系列模型定价,并引入峰谷分时计费模式。空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅60%;缓存未命中降至1元,降幅33.33%;输出降至4元,降幅11.11%。高峰时段(工作日9:00-12:00、14:00-18:00)价格为空闲时段2倍,同步下调。此举标志国产大模型API定价进入精细化运营阶段,用价格杠杆引导用户错峰调用,缓解算力高峰压力。

关键信息

  • DeepSeek官宣9月10日12:00起调整flash系列模型定价,首次引入峰谷分时计费模式
  • 空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅最高达60%
  • 高峰时段划定为工作日9:00-12:00及14:00-18:00,价格为空闲时段的2倍
  • 空闲时段输出价从4.5元降至4元/百万Token,降幅11.11%,高峰输出价降至8元

🔥犀利点评

别被「降价60%」的标题唬住,砍得最狠的是缓存命中价——这是奖励已有大客户的优惠,新用户感知有限。真正的看点是峰谷分时计费:DeepSeek把电网运营思路搬进了大模型商业,用价差把非紧急推理任务赶到深夜,变相提升GPU利用率。输出价只降11%也说明推理成本仍是硬骨头。这招既赚了降价声量又省了算力扩容的钱,一石二鸟,国内同行迟早跟进。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文