该模型于8月13日凌晨通过API文档悄然更新,在保持1.6万亿总参数架构不变的情况下,重点优化后训练策略以增强智能体执行长链路任务的能力。
2026年8月13日凌晨,深度求索(DeepSeek)官方在未召开发布会且无预告推文的情况下,于API文档中将V4 Pro模型版本更新为0813正式版。该动作标志着自同年4月24日预览版发布后,历经111天的迭代终于完成转正。新模型延续了原有的Mixture of Experts架构设计,维持1.6万亿总参数与每次推理激活490亿参数的规格,同时支持100万token上下文窗口及38.4万token输出上限,接口兼容OpenAI与Anthropic两种格式,默认开启思考模式。
在核心性能指标上,正式版展现了显著的变化,尤其是在软件工程智能体(Agent)任务领域。官方数据显示,DeepSWE基准测试分数从预览版的12.8分跃升至62.7分,增幅接近4.9倍;DSBench-Hard从31.1提升至67.2,DSBench-FullStack从41.8增长至71.1;Terminal Bench 2.1得分达到87.9,Cybergym网络安全测试成绩为83.3。这些数据的提升表明模型在长周期代码修改、环境交互及工具调用等复杂场景下的稳定性大幅增强。
尽管性能数据亮眼,但在第三方社区进行的实际应用中,该版本仍暴露出部分视觉生成与逻辑结构的缺陷。测试显示,在“鹈佩骑自行车”等特定图像描述任务中,模型出现了踏板脱离、物体悬浮及月亮形状错误等画面结构问题,即便调整推理强度也未完全消除。价格方面,正式版维持了此前预告的高端定价策略,按每百万token计算,缓存未命中输入费用为3元,输出费用为6元,相比之下V4-Flash版本对应价格为1元和2元,显示出Pro版在成本上的明显溢价。