深度求索于8月17日零点生效新计费规则,将每日9至12点及14至18点设为高峰时段收费翻倍,空闲时段半价,同时V4-Pro结束测试转为全面商用服务。
深度求索(DeepSeek)宣布其DeepSeek-V4系列API全新定价方案于北京时间2026年8月17日零时正式生效,标志着V4-Pro版本结束测试阶段并全面转为正式商用服务。此次调整摒弃了此前的统一计费模式,转而采用算力错峰分级计价策略,旨在通过价格杠杆引导开发者将非实时任务调度至低负载时段,从而优化资源分配并缓解高峰期服务不稳定的问题。
新定价体系将每日9:00至12:00及14:00至18:00划定为高峰时段,其余时间均为空闲时段。在计费标准上,空闲时段的费用设定为高峰时段的一半,计价单位为每百万tokens。具体而言,DeepSeek-V4-Flash模型在空闲时段的输入(缓存命中)价格为0.05元、未命中为1.5元、输出为4.5元;若处于高峰时段,对应价格则分别调整为0.10元、3.0元和9.0元。性能更强的V4-Pro模型定价更高,其空闲时段输入(缓存命中)为0.15元、未命中为4.5元、输出为13.5元,高峰时段价格则翻倍至0.30元、9.0元和27.0元。两款模型均原生兼容OpenAI Responses API格式及Codex专项适配,支持工具调用、对话续写及FIM补全功能,最大上下文输出长度可达384K。
相较于8月12日上线的V4-Pro初始定价(输入缓存命中0.025元、未命中3元、输出6元),新方案在高峰时段的价格涨幅显著。特别是针对输入缓存命中场景,V4-Pro的价格从0.025元上升至0.30元,幅度达到11倍;未命中输入价格从3元涨至9元,输出价格从6元涨至27元。此次调价被视为DeepSeek从早期低价策略转向精细化运营的重要节点,通过市场化手段平衡算力供需,同时也为企业开发者提供了更具弹性的成本控制方案,用户可根据任务特性选择在不同时段调用模型以匹配预算与性能需求。