明天12点,DeepSeek flash系列将降价
9月9日,DeepSeek开放平台公告,将于北京时间2026年9月10日12:00起,调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。高峰时段是指北京时间周一至周五9:00-12:00、14:00-18:00(其余为空闲时段)。
调价信息
缓存命中输入降价六成
这次降价,最狠的是“缓存命中输入”,直接砍掉六成,从每百万tokens五分钱变成两分钱。其他两项——缓存未命中输入和输出——也降了,分别是33%和11%左右。
缓存命中翻译成大白话:如果你反复问AI同一个问题,或者让AI处理大量重复性内容,这部分成本会明显降低。对普通用户来说,感知可能不强,但如果你是个用API做应用的开发者,或者公司里经常调用AI接口的运营人员,这个变化会实打实反映在月底账单上。
需要注意的是,官方同时明确了两件事:一是高峰期(工作日9:002:00、14:00-18:00)价格翻倍,二是闲时便宜很多。换句话说,DeepSeek在用价格信号引导用户把不那么急的任务挪到晚上或周末去跑。
算笔账,做一次任务能省多少?
举个最典型的场景——你在闲时调用AI,消耗100万tokens的输入(未命中缓存)和100万tokens的输出。按老价格是1.5+4.5=6元,新价格是1+4=5元。省了1块,约16.7%。
比例不算夸张,但如果你每天调用量是“千万级”甚至“亿级”呢?运营同学应该懂省多少。
真正能省大钱的,是那些缓存命中率高的场景。比如客服机器人回答常见问题、文档总结类任务复用固定提示词、或者长对话中重复使用的系统指令。这些场景下,成本下降会很可观。
DeepSeek背后打的什么算盘?
从价格策略看,DeepSeek的思路其实挺清晰的:用低价抢市场。Flash系列本来就是轻量级模型,价格一直压得很低,这次再降,摆明了是要在性价比这条路上走到底。同时,用价格杠杆调峰填谷。云服务行业玩了很多年的“闲时降价”策略,现在被复制到了大模型API市场。对平台来说,把部分非紧急任务引导到闲时,能更充分地利用算力资源。还在培养开发者习惯。缓存命中降价最多,等于在喊话:好好设计你的调用逻辑,多用缓存,对钱包好。
如果你不是开发者,可能暂时感受不到这份调价通知的分量。但换个角度想:API降价,意味着用AI能力做产品的成本在降低。成本降低,最终会传导到终端产品上——也许过段时间你会发现,某个你常用的AI应用变便宜了,或者免费额度变多了。
趋势很明确,大模型调用成本还在往下走。这对整个行业是好事,对普通用户也是好事。
不过官方也提醒了一句:这次是“闲时低价”策略,着急出结果的任务,该付的钱还是得付。
0人