灵骏真武M890上线支撑两万亿参数大模型
「阿里云宣布灵骏真武M890超节点实例全面上线,成为国内首个运行超2万亿参数大模型的超节点算力。该产品搭载真武M890芯片与ICN Switch互联,实现64卡800GB/s高速互联,单实例支持十万亿参数级MoE推理,性能较上代最高提升三倍。」
阿里云近日正式宣布旗下灵骏真武M890超节点实例全面上线,首批已在乌兰察布地域开售。这一国产算力产品的发布,标志着国内在超大规模模型训练与推理领域取得了关键性突破,也为企业级客户提供了更高效、更灵活的云端智能算力选择。
作为国内首个成功运行超2万亿参数大模型的超节点形态算力,灵骏真武M890一经推出便获得了主流大模型的支持。目前,知名大模型如Kimi K3以及阿里最新旗舰模型Qwen3.8 Max均通过该实例对外提供云端服务,其中Qwen3.8 Max的参数规模高达2.4万亿。这一事实充分验证了灵骏真武M890在处理极端大规模模型时的工程能力与稳定性。
在硬件架构方面,灵骏真武M890超节点实例搭载了平头哥新一代训推一体AI芯片——真武M890。该芯片原生支持从FP32到FP4的多种数据精度,能够根据不同的训练和推理需求灵活调整计算精度。搭配ICN Switch 1.0互联芯片,该实例实现了64张加速卡间800GB/s的高速互联,显存池规模达到9TB。这样的硬件配置使得单实例即可轻松支撑超大规模2万亿参数MoE模型的专家并行需求,大幅降低了超大规模模型的部署门槛。
除硬件规格外,灵骏真武M890在软件层面也进行了深度优化。得益于底层软硬件的全链路协同设计,该超节点原生支持FP8和FP4低精度计算,在智能驾驶、具身智能等典型训练场景中,多场景性能相较于上一代真武810E最高可提升三倍。在Agentic推理场景中,它同样能实现最高1.5倍的性能提升。这意味着企业客户无需自建机房,即可在云上直接开通64卡高速互联算力单元,单实例最高可承载十万亿参数级MoE大模型的推理任务,大幅降低了超大规模模型的算力获取成本。
在底层智算支撑层面,灵骏真武M890超节点依托统一底座的灵骏智算平台,并搭载了HPN 8.0训推一体网络。其单集群最高可支持13万卡异构算力混布,并能弹性扩展至百万卡级别。这样的网络与调度能力,为当前爆发式增长的大规模AI负载提供了坚实的算力底座,也为未来更大规模模型的研发与落地奠定了基础设施基础。
来源:Heooo AI工具导航