今天早上,很多开发者的朋友圈可能已经被一张截图刷屏了——DeepSeek API从8月17日零点起正式启用峰谷定价机制,缓存命中输入的价格从0.025元/百万Token直接跳到0.30元,涨幅1100%。
这个数字听起来很吓人。我们来好好聊聊,这件事到底意味着什么。
简单说,DeepSeek把一天分成了两档:
高峰时段(北京时间9<00>00>—12<00>00>、14<00>00>—18<00>00>):价格是基准价的2倍。
空闲时段(其余时间,含夜间、周末、节假日):价格是基准价的1倍,也就是半价。
所以你看到的涨价,不是无脑涨,而是在高峰时段涨,在空闲时段反而比原来还便宜。
最夸张的数字来自缓存命中输入——涨幅1100%。但这个场景其实很特殊,缓存命中意味着DeepSeek已经「见过」类似的请求,可以直接复用计算结果,是成本最低的调用方式。绝对价格从0.025元到0.30元,听起来翻了很多倍,但实际换算下来,100万次缓存命中调用也才多花不到3毛钱。
真正影响开发成本的,是输出Token的价格——V4-Pro峰值输出从6元涨到27元,涨幅350%,这个才是开发者真正需要心疼的数字。
轻量版的V4-Flash也涨了:输出Token从2元涨到9元,缓存未命中输入从1元涨到3元,涨幅在200%—350%之间。
这是最容易被混淆的地方:API涨价只影响开发者和企业,你在网页上用DeepSeek网页版、在App上跟它聊天,这些体验完全不受影响,继续免费。
所以你在朋友圈看到的「DeepSeek涨价」新闻,大概率是开发者在哀嚎,跟你每天用的那个对话框没有半毛钱关系。
两个原因。
第一,Agent化调用让Token消耗量激增。现在的AI应用不再只是回答问题,而是自动拆解任务、调用工具、反复查询上下文,一个任务可能消耗掉过去十倍的Token。DeepSeek V4-Pro正式版(8月13日上线)专门强化了Agent能力,正是这股风潮的产物。
第二,高端算力供给持续承压。DeepSeek之前的定价策略一直是「赔本赚吆喝」,用极低的价格吸引开发者,构建生态护城河。但当调用量越来越大、自己又准备IPO的情况下,成本压力就不得不传导出去。
这不只是DeepSeek一家的事。腾讯云、智谱等国产模型厂商今年都已多次提价。整个行业正在从「价格战换份额」回归到「成本传导与合理毛利」的新阶段。
对于重度依赖DeepSeek API的开发者来说,接下来有几个实用建议:
错峰调用:把非紧急任务排到空闲时段,可以节省50%的成本。这对有批量处理需求的开发者来说是基本功。
用缓存命中优化:如果你的请求有规律可循,尽量让DeepSeek命中缓存,0.30元比9元的输出Token便宜太多了。
多模型路由:同一个任务,可以尝试在DeepSeek和其他模型之间做成本比较,用最合适的模型做最合适的事。
尽快重算成本模型:之前按照2元/百万输出Token做的商业计划书,现在得重新按9元或27元来算了。
DeepSeek这次调价,本质上是在宣告一件事:国产大模型的「低价红利期」正在收尾。
过去两年,DeepSeek一直是AI行业的「价格屠夫」,用极低的定价搅动市场,逼着所有人跟着降价。但低价从来不是商业可持续的护城河,当市场格局稳定、用户习惯养成、IPO在即,「回归商业理性」就是必然选择。
对于普通用户:不用慌,你继续免费用。 对于开发者:别光抱怨,赶紧优化调用策略,办法总比困难多。 对于整个行业:这是一次压力测试,能扛过去的AI应用才能真正证明自己的价值。
低价是入场券,不是终局。
正在加载评论...