该系列采用天文学命名体系包含Sol、Terra、Luna,分别定位旗舰推理、高性价比开发及高吞吐量场景,并推出双模式推理架构。
OpenAI正式推出GPT-5.6系列人工智能模型,包含Sol、Terra和Luna三款产品,首次启用天文学概念作为型号标识。这一命名体系确立“数字代际+能力层级”的双维度框架,其中Sol对应太阳,定位为旗舰级推理模型;Terra象征大地,面向高性价比开发需求;Luna取自月亮,专注于高吞吐量数据处理场景。该系列模型在编程基准、网络安全及生物医学领域展示了显著的技术进展。
在核心性能指标方面,旗舰型号Sol在Terminal-Bench 2.1编程测试中取得91.9%的准确率,超越竞争对手Anthropic发布的Claude Mythos 5(88.0%)以及Fable 5(84.3%)。该模型引入max和ultra两种推理模式:max模式通过延长思考时间优化复杂任务处理,ultra模式则具备将单一任务拆解为多个子智能体并行执行的能力。在网络安全测试ExploitBench中,Sol的表现接近Anthropic未公开的Mythos Preview版本,但输出Token消耗量降低三分之二;在CTF夺旗赛中命中率达96.7%。生物医学领域数据显示,Sol在GeneBench v1基因组分析中以更少Token完成复杂任务,其HealthBench Professional医疗诊断得分达到60.5分,较前代版本提升8.7分。此外,Terra与Luna被确认在网络安全和生物领域同时获得High评级,显示技术下放策略已生效。
定价策略呈现明显的梯度差异:Sol输入成本为5美元/百万Token,输出为30美元/百万Token;Terra输入2.5美元/百万Token,输出15美元/百万Token,价格约为上一代旗舰的一半;Luna输入仅需1美元/百万Token,输出6美元/百万Token,适用于批量处理与高并发场景。技术架构上,ultra模式实现的自主智能体协作机制与需人工设计流程的竞品方案形成差异。目前该系列模型API及Codex访问权限仅向约20家受信合作伙伴开放,官方表示将在未来几周内逐步扩大服务范围,普通用户尚无法立即使用。