在7月推出峰谷定价机制后,该公司计划近期调整全部接口价格,涉及V4-Flash与V4-Pro两款模型的具体计费标准及缓存策略。
DeepSeek于2026年8月6日在其用户后台发布通知,宣布计划在近期对全部API接口服务实施整体价格上调,预计涨幅较大。官方建议企业与个人开发者提前规划调用量并控制充值金额,具体的调价细则与生效时间将另行通过正式公告公布。此次调整发生在该公司7月中旬引入峰谷定价机制之后,当时已规定工作日高峰时段(北京时间9:00至12:00、14:00至18:00)价格翻倍,而凌晨及周末节假日执行平峰原价。
当前DeepSeek的计费体系基于输入与输出Token的数量进行差异化计算,并依据缓存是否命中设定不同单价。在现有的DeepSeek-V4-Flash模型中,平峰时段缓存命中的输入价格为每百万Token 0.02元,未命中为1元,输出为2元;高峰时段上述价格均翻倍。该版本支持100万Token上下文窗口,最大单次输出384K Token,硬件并发上限为2500,并兼容OpenAI与Anthropic接口格式。DeepSeek-V4-Pro作为高性能模型,平峰时段缓存命中输入价为0.025元/百万Token,未命中为3元,输出价为6元/百万Token。此次涨价前,V4-Flash在缓存未命中输入场景下的成本为1元/百万Token,而缓存命中时仅为0.02元/百万Token。
行业分析指出,DeepSeek此前的定价策略使其在标准化任务的实际加权平均成本上显著低于国际竞争对手。据相关评估数据,其V4-Flash模型成本约为0.03美元,而同期Kimi K3、OpenAI GPT-5.6 Sol及Anthropic Claude Fable 5的价格分别处于更高区间。与此同时,Meta于同日推出名为Muse Spark 1.2的新模型及编程Agent Muse Code,其定价策略包含允许数据共享的“贡献者套餐”,输入价格低至0.10美元/百万Token。随着DeepSeek预告涨价以及智谱等国产模型在优惠结束后拟调高价格,全球大模型市场竞争焦点正从单纯的价格战转向成本、利润与用户接受度的重新平衡,市场对涨价后DeepSeek能否维持原有竞争优势表示关注。