该模型预览版于 4 月开源,本次更新将优化 API 资源分配策略,高峰时段输入输出价格翻倍以平衡算力负载。
DeepSeek 团队于 6 月 29 日正式公布 DeepSeek V4 模型的上线计划,确认正式版将于 7 月中旬发布。此次版本迭代旨在进一步提升模型在智能体代理、世界知识储备及逻辑推理等方面的表现能力,同时为缓解算力资源紧张状况并保障服务稳定性,官方同步宣布对 API 调用价格策略进行重大调整,引入基于时间段的峰谷定价机制。
根据披露的价格方案,API 计费将区分高峰与平峰时段,高峰时段收费标准设定为平时价格的 2 倍。具体高峰时间段划定为每日上午 9 时至 12 时、下午 14 时至 18 时,其余时间维持原定价标准。在价格数值方面,V4-Flash 模型在高峰期的输入成本为每百万 token 2 元(缓存命中可低至 0.02 元),输出成本为每百万 token 4 元;V4-Pro 模型受算力成本影响定价较高,高峰期输入为每百万 token 6 元(缓存命中 1 元),输出为每百万 token 12 元。该模型预览版自今年 4 月 24 日上线以来,凭借百万字超长上下文处理能力及在开源领域的领先性能受到关注。
此次定价调整引发了市场对于算力资源分配与成本控制之间平衡的讨论。尽管部分用户对价格上涨表示担忧,但官方解释称此举是为了更合理地配置资源以应对高并发需求。分析认为,即便在引入 2 倍溢价机制后,DeepSeek V4 的整体价格水平相较于国际同类主流模型仍具有显著优势。随着正式版临近发布,其实际部署效果以及对昇腾 950 等国产硬件的适配情况,将成为观察其后续市场表现的关键变量。