该模型于8月8日上线Grok全平台及API接口,在文生图与图像编辑榜单中仅次于OpenAI GPT Image 2,主打商业场景下的局部修改与多轮编辑。
马斯克的xAI公司于2026年8月8日正式推出Imagine Image 2.0图像生成模型。该版本作为新的质量模式部署在Grok.com网页端以及iOS、安卓移动应用中,同时向开发者开放了API接口。此次更新的核心在于提升模型对复杂指令的遵循能力,使其在处理包含文字排版、版式结构及多元素布局的画面时更加精准,特别是显著改善了小字号文字的渲染清晰度。此外,模型能够在多轮交互中稳定保留用户设定的主体特征,减少迭代过程中的信息丢失。
针对专业图像编辑场景,Imagine Image 2.0引入了一系列面向工作流的工具功能。其中包括魔棒局部修改工具,允许用户在保持画面其他区域不变的情况下,仅对选定的指定区域进行调整;分割功能支持精确框选图像特定部分进行独立调色或素材替换;背景移除工具可直接输出透明背景的主体素材以利于二次合成。模型还支持单次输入最多5张参考图以实现多素材融合,并具备智能尺寸调整功能,能够根据用户设定的目标比例自动补全画面框架。
根据xAI引用的Arena Text-to-Image和Image Edit排行榜数据,截至2026年8月7日,该模型在文生图生成与图像编辑两项关键指标上均位列全球第二,排名仅次于OpenAI的GPT Image 2模型。这一排名的取得标志着xAI在视觉生成领域的技术实力已接近行业顶尖水平,特别是在商业设计、产品实拍等需要高精度局部控制和多轮编辑的真实应用场景中展现出竞争优势。