华为Ascend 960DT芯片提前发布,性能翻倍 封面图
行业资讯

华为Ascend 960DT芯片提前发布,性能翻倍

Heooo 09月17日22时30分 30 阅读

「华为宣布将下一代AI芯片Ascend 960DT的发布提前至2027年第一季度,原计划为第三季度,芯片性能将翻倍并逐年迭代。华为同时披露Peerium Computing Architecture,借助UnifiedBus互联技术把海量芯片组成统一计算系统,Atlas 950 SuperCluster最多可连接256000张加速卡。」

在华为Connect大会上,华为轮值董事长David Wang宣布,新一代AI芯片Ascend 960DT的发布计划提前至2027年第一季度。此前该芯片的规划发布时间为2027年第三季度,此次调整意味着整个产品节奏被大幅前移。华为方面表示,Ascend 960系列芯片将提前推出,性能实现翻倍,并在后续年份逐年迭代升级。

性能翻倍是这次时间表调整中最受关注的信息。对于AI芯片而言,单代产品性能翻倍并非易事,通常需要在计算单元、内存带宽、互联能力等多个层面同时做出改进。华为将Ascend 960定位为面向大规模AI训练与推理的核心算力底座,并强调其迭代节奏将按年推进,这在一定程度上反映出其在芯片设计上的路线规划已经相对清晰。

与芯片本身同样重要的是华为提出的Peerium Computing Architecture。这一架构的核心思路是把数十万颗,乃至未来数百万颗AI芯片组合成一台巨型计算机,从而以集群规模弥补单芯片性能的差距。支撑这一架构的关键技术是UnifiedBus,按照华为的说明,UnifiedBus负责把处理器与内存、存储以及网络硬件连接到一起,使海量芯片之间的数据交换保持高效。

华为Ascend 960DT芯片提前发布,性能翻倍

华为轮值董事长Eric Xu在公司的声明中表示,华为正在利用新的Peerium Computing Architecture构建更大规模的AI计算系统,这些系统同时面向训练和推理两类负载。首批基于该架构的系统是Atlas 950 SuperPoD与Atlas 950 SuperCluster。华为称,一台Atlas 950 SuperCluster最多可以连接256000张加速卡,这种规模已经接近超大规模数据中心的算力组织方式。

不过,围绕这套系统的规模,外界也提出了疑问。科技分析师Rui Ma在社交平台X上指出,华为此前曾表示Atlas 960 SuperPoD可以扩展到15488颗Ascend 960芯片,而本周公布的系统仅涉及4096颗芯片。她认为,芯片本身的时间表大幅提前,但配套公布的SuperPoD规模比最初规划要小得多。这一差异说明,芯片发布节奏与系统级产品落地节奏之间可能存在不同步。

华为Ascend 960DT芯片提前发布,性能翻倍

从技术路线看,华为的策略与单纯追求单卡性能的思路有所区别,更强调通过互联与系统架构把大量芯片聚合成统一算力池。这种路线对互联带宽、内存一致性和调度软件都提出了很高要求,SuperPoD实际可扩展的芯片规模也因此成为衡量方案成熟度的重要指标。Ascend 960DT提前发布,加上Peerium Computing Architecture与UnifiedBus的持续推进,意味着这套系统级方案正在进入更密集的迭代阶段。对于开发者和算力使用者而言,值得关注的不仅是单颗芯片的峰值指标,还包括这套互联体系在真实训练与推理任务中的扩展效率、软件栈适配进度以及集群调度的稳定性,这些因素共同决定了集群规模优势能否真正转化为可用的算力产出。

# 华为 # AI芯片 # Ascend 960DT # 算力架构

来源:Heooo AI工具导航