马斯克称Grok 4.5在SpaceX和特斯拉内测,性能逼近Opus

6月28日 19:05
该模型基于1.5万亿参数V9架构并引入Cursor数据训练,早期评测显示其性能已接近Anthropic旗舰产品Opus,标志着xAI将进入高频迭代阶段。

埃隆·马斯克于6月28日在X平台公布,Grok 4.5大语言模型已在SpaceX及特斯拉内部启动测试程序。该版本基于自研的1.5万亿参数V9基础模型构建,并在训练过程中引入了Cursor相关数据进行补充优化。根据官方披露的早期评测结果,Grok 4.5在综合性能上已接近甚至有望超越Anthropic公司的旗舰模型Claude Opus。与此同时,基于人类反馈的强化学习技术仍在持续迭代中,旨在进一步提升模型的响应能力与准确性,配套的调度框架也处于每日更新状态。

在研发规划方面,马斯克明确表态SpaceX计划在今年剩余时间内保持每月推出一款全新大模型的节奏。这些即将发布的模型将完全从零开始训练,意味着未来的版本并非对现有系统的渐进式修补,而是通过全新训练构建的基础模型重构。这种高强度的发布频率显示出xAI团队正在执行极具进取心的研发周期,意图通过持续的技术迭代来扩展功能边界并提升性能上限。

这一动态反映了全球人工智能行业在模型性能竞赛中的加速趋势。随着头部企业不断刷新参数规模与测试基准,市场竞争焦点已从单纯的算力堆叠转向训练效率与数据质量的综合比拼。Grok 4.5的出现以及后续每月的全新模型计划,将直接增加与OpenAI、Anthropic及谷歌等竞争对手的博弈强度,同时也可能改变现有闭源大模型市场的格局。对于SpaceX和特斯拉的内部应用而言,新模型的快速迭代有望为其业务场景提供更强大的智能辅助支持。