DeepSeek V4 Flash单日调用8万亿Token登顶全球

8月2日 14:40
7月27日至8月2日周调用量达7.22万亿,OpenAI同期降价GPT-5.6 Luna应对但开发者仍倾向中国模型定价策略

2026年8月3日,海外开发者平台OpenCode宣布其支持的DeepSeek V4 Flash模型单日Token处理量达到8万亿。该数据由5万亿免费试用额度与3万亿付费调用构成。同期模型API聚合平台OpenRouter统计显示,在7月27日至8月2日的周期内,DeepSeek V4 Flash以7.22万亿Token的周调用量位居全球所有模型首位,环比增长13%,且全球前五名均为中国大模型。

DeepSeek V4 Flash正式版于7月31日上线公测,采用混合专家(MoE)架构,总参数规模为284B,激活参数量13B,上下文窗口支持最长100万Token。在OpenCode平台发布的官方数据显示,该模型上线后单日使用量增长30%,相关编程工具网关的新订阅用户数同步上升30%。OpenAI核心产品负责人Tibo曾在评论区尝试推广降价后的GPT-5.6 Luna模型,但多位开发者明确表示更倾向于DeepSeek的定价体系。

为应对竞争,OpenAI于7月31日将GPT-5.6 Luna的输出价格从每百万Token 6美元下调至1.2美元,输入价格从1美元降至0.2美元,降幅达80%,同时Terra模型也下调20%。然而分析指出,即便在降价后,DeepSeek V4 Flash的自有API单任务执行成本仍比Luna低约60%,主要得益于其98%的缓存命中折扣率,高于行业普遍的90%水平。这一成本优势与高性能指标共同推动了该模型在全球开发者群体中的快速普及。