英伟达发布针对AI智能体任务的300亿参数开源模型及路由工具,同时加速开发目标挑战全球顶尖水平的下一代千亿级参数大模型。
英伟达近期在开源人工智能领域推出多项进展,包括正式发布Nemotron 3.5 Lightning模型及其配套的智能路由库NeMo Switchyard,并同步启动下一代Nemotron 4系列的研发工作。此举旨在应对AI开发与运行成本上升的行业现状,同时响应全球对可及性高且限制较少的开源模型的需求增长。根据项目参与者披露的信息,英伟达计划通过开放模型生态来扩大生成式AI的应用场景,进而推动市场对自家GPU算力的持续需求。
Nemotron 3.5 Lightning是一款拥有300亿参数的混合专家架构模型,专为优化长时间运行的AI智能体工作负载而设计。与传统对话机器人不同,该模型侧重于支持多步骤推理、工具调用及复杂任务执行,旨在降低推理成本并提升运行效率。配套的NeMo Switchyard开源库能够根据具体任务需求,自动将指令分配给最合适的模型,支持在PC、工作站、数据中心及云端等多种计算环境中部署,且无需修改现有应用程序代码。此外,英伟达生成式AI副总裁Kari Briski表示,投资开源模型项目的核心逻辑在于确保每家企业及国家都能获取前沿技术。
在已发布的产品之外,英伟达正在加速研发规模更大的Nemotron 4系列。多名参与开发的员工透露,该系列中规模最大的版本预计参数数量至少达到1万亿个,这一数值约为今年6月发布的Nemotron 3 Ultra的两倍。目前该模型的最终训练尚未开始,具体发布时间表仍未确定,但有内部人员推测最早可能在今年秋末完成准备。为支撑这一战略,英伟达已于今年3月联合多家领先AI实验室成立Nemotron Coalition,并与其他科技巨头签署公开信支持开放权重模型,以应对创新能力外移的风险及网络安全领域的挑战。该系列首个模型将基于联盟开发的基础构建,旨在使Nemotron 4在性能指标上跻身全球顶级开源模型行列。