资讯
DeepSeek官宣flash系列模型降价 最高直降60%
📋总体概括
DeepSeek宣布自2026年9月10日12:00起下调flash系列模型定价,并首次引入峰谷分时计费模式。空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅达60%;缓存未命中价降33.33%至1元,输出价降至4元/百万Token;高峰时段价格为空闲时段两倍,高峰划定为工作日9:00-12:00及14:00-18:00。这是国内大模型厂商中较早系统性采用错峰定价的做法,意在削峰填谷、提升算力利用率,并以低价进一步抢占开发者生态。
⚡关键信息
- ▸DeepSeek公告2026年9月10日12:00起调整flash系列模型定价,采用峰谷分时计费
- ▸空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅达60%
- ▸输入缓存未命中价降33.33%至1元,输出价降至4元/百万Token,降幅11.11%
- ▸高峰时段价格为空闲时段2倍,划定为工作日9:00-12:00、14:00-18:00
- ▸价格战从单纯降价升级为精细化定价,引导负载向空闲时段迁移
🔥犀利点评
这步棋很聪明——大模型推理成本里最贵的就是高峰算力,与其像同行一样无脑卷价格,不如学电网搞分时电价,把夜间闲置GPU变现,等于用调度优化换出了降价空间。缓存命中价砍到0.02元更是把刀递给了高频调用的Agent开发者。但别高兴太早:高峰时段价格实际降幅有限,真正省钱的是能迁负载的应用商,中小开发者可能被倒逼去研究什么时段调便宜。价格战打到分时这一层,说明token生意的毛利已经薄到必须精细运营了。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →