该模型于8月12日正式上线,通过延长训练周期与引入工程数据强化长流程智能体任务能力,在CursorBench等基准测试中显著超越前代,并以每百万输入Token 2美元的低价策略进入市场。
xAI团队于8月12日推出Grok系列最新模型Grok 4.6,旨在提升在复杂智能体任务、代码生成及多模态交互领域的竞争力。该版本在延续前代优势的基础上,针对长周期运行任务进行了深度优化,能够自主处理包含数百个步骤的研究分析、架构设计及应用构建流程。在基准测试方面,Grok 4.6在Artificial Analysis Intelligence Index中获得61分,与OpenAI的GPT-5.6 Sol持平,仅次于Anthropic的Claude Opus 5和Fable 5,标志着其正式跻身全球顶级模型行列。
技术实现上,Grok 4.6的训练周期较前代延长40%,采用了三阶段强化策略:利用筛选后的模型生成数据构建推理基础,引入高级技术概念与工程数据优化架构,并配合改进型优化器完成参数调优。在视觉与交互工作流中,新模型首次实现“单次构图”能力,输入明确产品描述即可生成包含基础布局与设计规范的原型,较前代减少约60%的修改轮次。安全体系方面,研发团队执行了覆盖开发全周期的评估流程,包括部署前压力测试、防护机制校准及第三方渗透测试,在保持高拦截率的同时将合法请求误拒率控制在极低水平。
商业化部署同步展开,Grok 4.6已接入Cursor、Grok Build、OpenRouter、Vercel及Cloudflare等多个平台,并开放API服务。其定价策略极具差异化优势,设定为每百万输入Token 2美元、输出Token 6美元,相比GPT-5.6 Sol和Claude Opus 5等竞品便宜60%以上。尽管部分市场数据显示Anthropic在企业采用率上仍保持领先,但Grok 4.6凭借高性价比与前沿性能指标,直接对标OpenAI与Anthropic的旗舰产品,意在争夺高端编码与知识工作市场份额。