英伟达加速研发万亿级开源AI模型
「知情人士透露,英伟达正紧锣密鼓研发新一代开源模型Nemotron 4,参数规模预计至少达1万亿级别,旨在对标全球顶尖开源大模型,扩大开源AI生态影响力并带动GPU算力需求。此前其3400亿参数的Nemotron-4 340B系列已被广泛应用于训练数据生成与企业级AI应用。」
近日有知情人士透露,芯片巨头英伟达正在紧锣密鼓地研发其全新一代开源人工智能模型——Nemotron 4。据了解,该模型的参数规模预计将至少达到1万亿级别,其核心目标是对标全球顶尖的开源大模型,进一步扩大英伟达在开源AI生态中的影响力,并持续推升市场对高性能GPU算力的旺盛需求。
英伟达在开源模型领域早有布局。回顾过往,其此前已相继推出过多款备受瞩目的Nemotron系列开源模型,其中较为典型的代表是拥有3400亿参数的Nemotron-4 340B系列。这些技术成果此前主要被广泛应用于大语言模型的训练数据生成、核心模型开发以及各类企业级AI应用的落地。从340B到万亿规模的跨越,意味着英伟达正在将开源模型的体量提升至新高度,也间接反映出其对OpenAI、Meta等主流开源模型竞争压力的应对态度。
这一动态背后有着明确的商业逻辑。万亿级参数的模型训练与推理需要更庞大的算力支撑,而英伟达作为GPU市场的绝对领导者,其硬件产品正是这类超大模型的基础设施。因此,Nemotron系列的迭代不仅是模型技术的推进,更是一种围绕算力生态的战略协同——通过开源模型吸引更多开发者,进而带动其GPU芯片的销售与生态粘性。
针对这一趋势,长江证券分析指出,随着行业模型调用成本的大幅缩减,企业的试错门槛正显著降低。开发者能够在既定预算内开展更大规模的用户测试与产品迭代,这将有效催化多元落地场景的渗透步伐,并推动AI应用整体迎来关键的发展拐点。换言之,超大参数能力的开源模型一旦普及,将直接降低下游企业使用AI技术的成本,促使更多场景从概念验证走向规模化生产。
尽管英伟达尚未官方披露Nemotron 4的技术细节、训练数据规模与开源许可证类型,但仅从参数级别来看,这将是开源大模型领域的一次重要升级。对于整个行业而言,万亿级开源模型的到来,有望进一步拉近开源与闭源模型之间的能力差距,同时为全球开发者提供更强大的基础模型底座,加速AI应用的多元化创新。
来源:Heooo AI工具导航