OpenAI将下线GPT-5.3-Codex-Spark

9月13日 02:07
该实验模型运行于Cerebras WSE-3晶圆级处理器,主要服务ChatGPT Pro用户的编码任务,支持Codex、命令行与VS Code插件,并与750兆瓦算力建设相关。

OpenAI 的 Codex 负责人 Tibo 在 2026 年 9 月 13 日出现的公开信息中称,GPT-5.3-Codex-Spark 将在帖文发出后的一周内结束服务。该模型于 2026 年 2 月 12 日进入研究预览阶段,属于面向低延迟编码场景构建的轻量模型,也是其绕开特定 GPU 供应商推理路线后首个被安排退出的产品。

硬件方面,Spark 依赖 Cerebras 的 WSE-3 晶圆级处理器,将大量计算核心与片上存储集中在同一晶圆内,以降低计算单元和外部存储之间频繁数据搬运带来的等待。公开材料显示,OpenAI 与 Cerebras 自 2026 年 1 月起签订多年算力供应协议,规划总功率 750 兆瓦的推理集群,投资超过 200 亿美元,相关算力拟在 2028 年前逐步接入。另一组信息给出 Spark 每秒 1200 个 Token 的输出速度,但该模型的使用范围受限:它主要作为 ChatGPT Pro 用户的专属功能,入口包括 Codex 客户端、命令行工具和 VS Code 插件。

后续版本的推出使这类侧重速度优化的小模型面临更强的替代压力。2026 年 8 月推出的 GPT-5.6 SolUltrafast 模式同样建立在 Cerebras 架构之上,但调用完整的 GPT-5.6 Sol 模型,在维持每秒 750 个 Token 输出速度的同时覆盖更多编程任务。用户评价存在分化:部分开发者认可其在代码重构与局部修改等短任务上的响应表现,另有开发者认为其不适合生产环境,特别是在理解项目上下文和分析日志时会迅速占用窗口空间,导致需要另起会话。社区讨论还将注意力放在独立额度上,有用户希望类似机制延续到下一代模型,也有人将其作为主额度耗尽后的备选入口。两份材料对存续时长的表述不一致,一处写为不足八个月,另一处写为七个月。