摩尔线程Day-0支持智谱GLM-5.3-Flash
「摩尔线程宣布基于MTT S5000智算卡及MUSA软件栈,Day-0支持智谱开源GLM-5.3-Flash模型。该模型总参数320B,激活18B,AA指数57分,编程表现与Claude Opus 4.8相当。工程团队针对KDA机制完成算子定制与深度调优,实现极速适配与高效运行。」
智谱近日上线并开源了GLM-5.3-Flash(320B-A18B)模型,作为GLM-5系列的首个原生多模态模型,其总参数达到320B,而激活参数仅18B。在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中,该模型取得了57分的成绩,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其编程表现也与Claude Opus 4.8相当。
摩尔线程官方今日宣布,基于AI训推一体智算卡MTT S5000及MUSA软件栈,实现了对GLM-5.3-Flash的Day-0支持,即模型发布当日即完成极速适配与高效运行。此前,该模型以代号Ox-Alpha(社区昵称“牛来”)在OpenCode和OpenRouter进行匿名公测,凭借出色的推理速度与智能表现,迅速成为当周最受欢迎的模型,创下双平台调用量新高。
在GLM-5.3-Flash发布当日,摩尔线程工程团队便完成了模型架构拆解、核心技术分析与典型算子梳理。针对该模型混合架构中线性注意力采用的KDA机制,团队基于MATE算子优化引擎,快速完成了状态矩阵更新、分块并行扫描等全新算子形态的定制实现与深度调优,并与SGLang-MUSA缓存管理体系深度协同、无缝打通,从而释放了KDA在长上下文推理中的效率优势。
这一Day-0支持体现了摩尔线程在AI基础设施领域的高效响应能力,也展示了国产智算卡与主流大模型生态的紧密协同。通过MUSA软件栈的持续优化,开发者可以更快地在摩尔线程硬件上部署最新模型,降低推理成本并提升性能。此次适配也为GLM-5.3-Flash在更广泛场景中的落地提供了坚实算力基础。
来源:Heooo AI工具导航