深度求索于7月31日通过API文档宣布该模型上线,基准测试显示其智能指数为50分,依托98%缓存命中率在单任务成本上较竞品GPT-5.6 Luna低约60%,同时第三方平台提示V4正式版可能于8月3日发布。
深度求索(DeepSeek)于7月31日通过API发布日志正式宣布DeepSeek-V4-Flash模型上线公测,标志着该系列大语言模型从测试阶段进入公开服务环节。此次更新由官方API文档直接确认,随后被多家国际AI基准测试机构纳入评估体系。该事件的核心在于模型在保持较低推理成本的同时,实现了接近行业顶尖水平的智能表现,引发了对后续正式版V4发布时间及定价策略的广泛关注。
根据Artificial Analysis发布的基准测试结果,DeepSeek V4 Flash 0731版本在人工智能分析智能指数(AII)中录得50分。该分数高于其内部前代版本DeepSeek V4 Pro的44分,同时也比2026年4月发布的DeepSeek V4 Flash高出10分。在与外部竞品的对比中,该模型得分仅落后于OpenAI的GPT-5.6 Luna(51分)1分。值得注意的是,尽管OpenAI近期宣布将GPT-5.6系列价格下调80%,但得益于DeepSeek提供的约98%缓存命中折扣,DeepSeek V4 Flash 0731在自有API上的单任务执行成本仍比GPT-5.6 Luna低约60%。这一成本优势主要源于其远超行业平均90%水平的缓存命中率,使得高并发场景下的推理效率显著提升。
在V4系列后续发展方面,市场出现了关于正式版V4发布节点的新动向。第三方服务商硅基流动发出通知,计划自8月3日起将DeepSeek V4 Pro的缓存命中价格从每百万Token 0.1元上调至1.0元。该调价动作被外界解读为正式版本即将发布的信号。与此同时,部分开发者通过API接口测试发现,模型已能准确回答此前无法获取的Claude Opus 4.5及Sonnet 4.5发布日期等新知识,且服务稳定性波动符合灰度测试特征。当前行业格局中,OpenAI通过大幅降价巩固性价比优势,国内竞品GLM则出现订阅价格上涨现象,DeepSeek V4系列在成本控制与性能平衡上的策略或将成为其在8月初面临的主要竞争变量。