OpenAI 10万亿参数Bel模型被曝完成预训练

8月30日 12:58
该模型被描述为Doug之后的新一代基座,面向通用人工智能目标,相关信息称其在编码、推理与长时程任务上超过Astra,并可连续运行数天、调度数百个并行子智能体。

围绕OpenAI的新模型Bel,目前出现一组信息:OpenAI被指已完成这一代号的超大规模预训练,参数规模达到10万亿。按照现有说法,它是Doug之后的下一代基座模型,研发方向指向通用人工智能,也被称作GPT-6之后的基座模型。

在能力与架构层面,相关信息称Bel在编码、推理与长时程智能体任务上的表现超过Astra,并采用双轨学习机制。它能够在无人干预状态下持续运行数天,期间可修复错误,同时协调数百个并行子智能体。工程端的关键变化包括Jalapeño芯片底层代码被全面接管,以及AI编写的核心代码运行效率比人类工程师高1.8倍。为集中算力,OpenAI被指缩减Sora视频生成与Altas浏览器等项目;另有测算把训练一次Bel的消耗等同于购买10万张高端GPU芯片。内部运营数据也被提及,其中通过自动化方式优化基础设施后,运营成本削减幅度达到80%。

在人员与路线图方面,丹尼斯·德雷瑟、布拉德·莱特卡普和菲姬·西莫等高管相继离开,OpenAI Codex负责人Tibo则称现有最强模型可能在三个月内显得落后。相关规划还包括将ChatGPT与Codex进一步融合,形成Personal AGI,并以动态UI适配不同用户身份。竞争维度上,内部评估称Anthropic受算力限制,在2026年内难以推出同等规模模型;Bel的亮相窗口则被放在今年年底前或Astra上线后数月内,而Astra本身也曾被指可能在下周四发布并扩大测试范围。