资讯

DeepSeek官宣flash系列模型降价 最高直降60%

驱动之家·2026/9/9 01:32:00🔗 原文

📋总体概括

DeepSeek宣布自2026年9月10日12:00起下调flash系列模型定价,并首次引入峰谷分时计费模式。空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅达60%;缓存未命中价降33.33%至1元,输出价降至4元/百万Token;高峰时段价格为空闲时段两倍,高峰划定为工作日9:00-12:00及14:00-18:00。这是国内大模型厂商中较早系统性采用错峰定价的做法,意在削峰填谷、提升算力利用率,并以低价进一步抢占开发者生态。

关键信息

  • DeepSeek公告2026年9月10日12:00起调整flash系列模型定价,采用峰谷分时计费
  • 空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅达60%
  • 输入缓存未命中价降33.33%至1元,输出价降至4元/百万Token,降幅11.11%
  • 高峰时段价格为空闲时段2倍,划定为工作日9:00-12:00、14:00-18:00
  • 价格战从单纯降价升级为精细化定价,引导负载向空闲时段迁移

🔥犀利点评

这步棋很聪明——大模型推理成本里最贵的就是高峰算力,与其像同行一样无脑卷价格,不如学电网搞分时电价,把夜间闲置GPU变现,等于用调度优化换出了降价空间。缓存命中价砍到0.02元更是把刀递给了高频调用的Agent开发者。但别高兴太早:高峰时段价格实际降幅有限,真正省钱的是能迁负载的应用商,中小开发者可能被倒逼去研究什么时段调便宜。价格战打到分时这一层,说明token生意的毛利已经薄到必须精细运营了。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文