微软发布 MAI-Image-2.6-Flash 图像模型

9月5日 14:58
新模型经 Microsoft Foundry 开启公开预览,主打低延迟与更低推理成本,适配交互式创作、快速迭代及规模化自动化任务;高精度商业设计与最终生产素材仍由主线版本承担。

9月4日,Microsoft Foundry 平台开始公开预览微软自研图像生成模型 MAI-Image-2.6-Flash;官方说明将该模型定位为 MAI-Image-2.6 的轻量版本,重点是压缩推理延迟和单位调用成本,同时沿用主线版本的核心生成与编辑能力。

API 费用按每百万 Token 计。Flash 的文本输入、图像输入、图像输出分别为1.75美元、2.50美元、19美元;同口径下 MAI-Image-2.6 对应价格为5美元、8美元、38美元。AIBase 将上述价格变化概括为降本超过50%,并给出测试结果:生成速度达到 GPT-Image-2-Medium 的2.8倍,整体综合效率提升72%。ITHome 的标题则将相对速度表述为全球最佳 AI 模型的2倍,两项说法未对齐。

功能侧,Flash 支持与主线相同的对象移除/替换、局部重绘、属性修改和文字更新操作,既能由文本生成图像,也能编辑已有图像。系列层面,MAI-Image-2.6 还提供最多5张参考图输入、基于 Bing 搜索的外部信息补充,以及动态宽高比和更高分辨率输出的原生处理能力,用以维持多张图片中角色与产品的表现一致。微软建议高质量商业设计、最终生产资产、复杂编辑和强文字渲染需求继续交给主线模型,Flash 则服务交互式界面、创意快速验证、批量自动化等高吞吐请求。Mustafa Suleyman 也在社交平台发布相关推文。

在 MAI-Image-2.6 此前进入技术榜单前列之后,这次推出增加了低时延、低单价选项,使微软图像生成模型矩阵覆盖高并发与成本敏感的工程化负载;对开发者而言,可在画质上限、响应速度和调用成本之间做更细的应用分配。