技术进展

印度Sarvam AI宣布开发万亿参数大模型

Heooo 07月31日12时00分 19 阅读

「印度人工智能企业Sarvam AI在首届Sarvam Epoch会议上宣布将开发万亿参数级AI模型,旨在实现印度自主生产AI Token,避免对外国企业“双重付费”。该公司现有105B模型表现出色,语音模型性价比领先全球。新模型预计六个月内完成,将应用于编程、网络安全、科研等领域。同时,Sarvam AI宣布在美国设立办事处,吸引印度裔人才回流,并发布Bulbul V4和Saaras V4两款语音模型。」

印度人工智能企业Sarvam AI在近日开幕的首届Sarvam Epoch会议上宣布了一项雄心勃勃的计划:开发参数规模达到万亿量级的人工智能模型。这一举措标志着印度在自主大模型研发领域迈出了重要一步,也反映了全球AI竞争格局向多元化发展的趋势。

Sarvam AI表示,其现有的105B参数模型在诸多方面表现出色,尤其是在语音处理领域,其语音模型能够提供显著优于全球竞争者的性价比。这一技术积累为开发更大规模的模型奠定了基础。万亿参数模型将大幅提升模型的理解和生成能力,有望在编程、网络安全、科学研究等专业领域与全球领先模型展开直接竞争。

推动这一大型模型开发的核心理念,是Sarvam AI所秉持的“印度应该生产自身消费的Token(词元)”信念。该公司认为,印度不应在数据和资金上向外国人工智能企业“双重付费”,即既支付模型使用费用,又输出本国数据资源。通过自主开发大规模模型,印度可以更好地掌控AI基础设施,保护数据主权,并促进本土AI生态的健康发展。

据透露,这一万亿参数模型预计将在未来六个月内完成。时间表相当紧凑,显示出Sarvam AI对自身技术能力和团队执行力的高度自信。若如期实现,该模型将成为印度首个达到万亿参数级别的大模型,为印度在AI领域赢得更多话语权。

在发布模型计划的同时,Sarvam AI还宣布将在美国设立办事处,以吸引当地印度裔人工智能人才回流。这一策略旨在弥补印度本土高端AI人才不足的短板,通过连接海外人才网络,加速技术研发和商业化进程。此外,该公司还公布了两款新的语音模型产品:Bulbul V4文本转语音模型和Saaras V4多说话人语音识别模型,进一步丰富了其产品矩阵。

Sarvam AI的举措反映了印度在全球AI浪潮中寻求自主发展的决心。随着更多国家和企业投入大模型研发,全球AI技术生态将变得更加多样化。对于开发者而言,这意味着未来将有更多选择,尤其是在非英语语境和特定区域需求方面,本地化模型可能提供更优的解决方案。

# Sarvam AI # 万亿参数模型 # 印度AI

来源:Heooo AI工具导航