资讯
DeepSeek官宣flash系列模型降价 最高直降60%
📋总体概括
DeepSeek发布开放平台公告,自北京时间2026年9月10日12:00起下调flash系列模型定价,并引入峰谷分时计费模式。空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅60%;缓存未命中从1.5元降至1元,降幅33.33%;输出从4.5元降至4元,降幅11.11%。高峰时段价格为空闲时段的2倍,周一至周五9:00-12:00、14:00-18:00为高峰,其余为空闲。此举进一步压低国内大模型API价格,加剧价格竞争。
⚡关键信息
- ▸DeepSeek官宣2026年9月10日12:00起调整flash系列模型定价,采用峰谷分时计费模式
- ▸空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅达60%
- ▸输入缓存未命中从1.5元降至1元(降幅33.33%),输出从4.5元降至4元(降幅11.11%)
- ▸高峰时段价格为空闲时段2倍,划定为周一至周五9:00-12:00、14:00-18:00,高峰价同样下调
- ▸缓存命中与未命中价差扩大至50倍,激励开发者优化缓存策略以摊薄推理成本
🔥犀利点评
峰谷分时计费这招其实是把电网调度思路搬进算力生意——白天算力挤破头、半夜GPU闲得慌,用价差削峰填谷,提高硬件利用率才是真目的。60%的降幅砸在缓存命中的价格上,等于明示用户:会用缓存的人拿最大折扣,DeepSeek借机筛选高质量API客户。这是API价格战打到地板后的精细化运营,拼的不再是单纯便宜,而是单位算力的变现效率。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →