内部代号 Skimaki 的新模型面向编程场景,在谷歌 Jetski 对照结果中得到高于 Opus 的工程师偏好,属于低算力、低成本的 Flash 序列,并与 DeepMind 管理层调整处于同一发布窗口。
围绕新一轮大模型竞争,谷歌准备把一项聚焦代码生成的更新投入对外使用。多份消息指向同一产品:名为 Gemini 3.8 Flash 的新模型,内部代号为 Skimaki,最早可能在当地时间周三开放,另有资料以次日作为预期窗口。此次更新的重心放在工程效率:它继续归属 Flash 系列,目标是减小体量、提升运行速度并压低使用成本。
能力验证方面,公开材料提到谷歌内部编码工具 Jetski 执行了一轮对照。结果中,参与工程师在编码任务里更常选中 Gemini 3.8 Flash,而不是 Anthropic 的 Opus 模型;这一结果来自编码场景内的实际操作。多家材料还指出,内部评估认为该模型在编程任务上降低了谷歌与 Anthropic、OpenAI 旗舰产品之间的落差。由于 Flash 系列不追求 Pro 级别的极限能力,它更适合对速度与成本更敏感的调用场景。
这一时间点与 DeepMind 的内部调整同步出现。上一个自然月,Demis Hassabis 从日常管理岗位转去部门主席位置,并兼任 Alphabet 首席科学家;长期与其协作的 Koray Kavukcuoglu 接手日常事务,职务升为 DeepMind 高级副总裁,并向团队提出加快落地速度的要求。材料还提到,谷歌今年把更多研发时间和算力投向强化学习,让模型通过反复试错改进代码输出,DeepMind 与其他实验室也并行推进多条模型线。在此之前,谷歌经历过阶段性落后:Gemini 3.0 去年 11 月发布后,系列在编程等关键性能上弱于 Anthropic、OpenAI 的头部模型;Character.AI 联合创始人 Noam Shazeer 与首席科学家 Jeff Dean 等人在今年夏天离岗。高端 Pro 系列的更新时间已经推迟数月,内部曾准备的 3.5 Pro 候选因为相对 Flash 的提升幅度不足而被搁置;下一阶段的 Gemini 4(另有一处记作 Gemini 4.0)在预训练环节取得正向反馈,后训练链路还没有走完。考虑到 Flash 版本计算需求较低,先把它推上线符合当前的交付安排。