谷歌发布Gemini 3.6 Flash等三款新模型,Pro版仍缺席

7月22日 00:05
美国当地时间2026年7月21日,谷歌DeepMind推出3.6 Flash、3.5 Flash-Lite及3.5 Flash Cyber三款侧重效率与特定场景的模型,同时宣布旗舰版3.5 Pro仍在测试中,公司历史上最大规模预训练项目Gemini 4已正式启动。

2026年7月21日,谷歌DeepMind团队正式发布了三款新型人工智能模型,分别为Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及专注于网络安全的Gemini 3.5 Flash Cyber。此次发布的核心策略在于提升AI智能体工作流的运行效率并降低Token消耗成本,而非单纯追求绝对性能的峰值突破。与此同时,谷歌确认备受期待的旗舰模型Gemini 3.5 Pro尚未完成测试,仍处于开发阶段,而公司历史上规模最大的下一代模型预训练项目Gemini 4已正式启动。

在具体参数与定价方面,主推的Gemini 3.6 Flash相比前代3.5 Flash版本,输出Token消耗量减少了17%,在DeepSWE基准测试场景下节省幅度最高达65%。该模型的输入定价维持在每百万Token 1.5美元,输出价格从9美元下调至7.5美元,并引入了0.15美元/百万Token的上下文缓存读取费用。代码与任务执行能力上,其在DeepSWE基准测试得分从37%提升至49%,MLE-Bench从49.7%升至63.9%,OSWorld-Verified从78.4%提升至83.0%,GDPval-AA v2指标也从1349增长至1421。Gemini 3.5 Flash-Lite定位为高吞吐、低延迟模型,生成速度达到每秒350个Token,输入与输出价格分别为0.3美元和2.5美元/百万Token,在Terminal-Bench 2.1等基准测试中较上一代Lite版本有显著提升。Gemini 3.5 Flash Cyber专为漏洞发现设计,基于V8引擎测试可识别出55个独立确认漏洞,优于前代模型及Claude Opus 4.6,目前仅对政府机构及受信任合作伙伴开放试点。

此次发布处于行业竞争加剧的背景下,包括xAI、OpenAI及Anthropic在内的竞争对手近期均推出了新版本模型。谷歌选择优先推出优化成本与效率的Flash系列,意在填补旗舰版延期带来的市场空档。官方表示,Gemini 3.5 Pro仍在与合作伙伴进行测试,一旦就绪将尽快开放,而Gemini 4的启动标志着公司在长期技术路线上的进一步投入。此次产品组合调整反映了AI行业从单纯追求模型规模转向关注实际部署成本与多智能体协同效率的趋势。