英伟达推进万亿参数开源模型
「芯片巨头英伟达正在研发新一代开源AI模型系列Nemotron 4,其中最大模型参数预计超1万亿,旨在与全球顶尖开源模型竞争。英伟达希望通过开放模型生态扩大AI应用范围,并推动市场对其GPU算力的需求。公司还同步发布Nemotron 3.5 Lightning模型及模型路由库NeMo Switchyard。」
据The Information援引项目参与者消息,芯片巨头英伟达正在研发新一代AI模型系列Nemotron 4,目标是与全球最先进的开源模型展开竞争。这标志着英伟达在开源AI领域进一步加码,希望借助开放生态扩大AI应用范围,并推动市场对其GPU算力的需求。
参与Nemotron 4开发的员工透露,该系列中规模最大的模型预计至少拥有1万亿个参数。目前英伟达尚未确定发布日期,最终训练也尚未完成,但员工认为该模型最早可能在今年秋末准备就绪。一旦发布,Nemotron 4将直接对标业界顶尖的开源模型,进一步丰富英伟达在生成式AI领域的产品矩阵。
英伟达生成式AI副总裁Kari Briski在邮件中表示:“投资Nemotron,是因为我们相信每家企业、每个国家都需要可及的前沿开源模型。”这一表态也体现了英伟达通过开放模型生态,降低AI使用门槛,同时带动其硬件销售的战略意图。与微软等科技巨头共同签署的公开信,也表明英伟达支持开放权重模型,以避免创新能力向海外转移。
在推进Nemotron 4的同时,英伟达还发布了Nemotron 3.5 Lightning模型,进一步扩充现有模型产品阵容。该模型主要面向代码审查、工具调用、安全警报监控、回答账单问题等任务,满足不同场景下的实际需求。此外,英伟达还推出开源模型路由库NeMo Switchyard,可根据不同AI任务的需求,自动将任务分配给最合适的模型,从而提升整体效率与精度。
今年以来,AI开发和运行成本持续攀升,而价格更具竞争力的开源模型在性能上逐步逼近顶尖闭源系统,使开源模型获得更多关注。近期接连披露的多起涉及自主AI智能体的黑客攻击事件,也加大了外界对开源模型网络安全特性的审视。英伟达上个月还与多家企业成立联盟,共同开发并共享AI安全和网络安全工具,试图在开源与安全之间寻求平衡。
整体来看,英伟达正通过多线布局强化其在AI产业链中的地位。从万亿参数的Nemotron 4,到面向特定任务的Nemotron 3.5 Lightning,再到模型路由工具NeMo Switchyard,英伟达正在构建一个从模型到基础设施的完整开源生态,为全球开发者提供更丰富的选择。
来源:Heooo AI工具导航