技术进展

Kimi K3开源与摩尔线程智算卡完成全栈适配

Heooo 07月29日19时33分 31 阅读

「月之暗面于7月28日开源了2.8万亿参数模型Kimi K3,这是全球首个开源的3万亿级别大模型,拥有100万token上下文窗口,原生支持视觉理解,并融合KDA混合线性注意力机制等多项架构创新。同日,摩尔线程宣布其AI训推一体智算卡MTT S5000及MUSA软件栈率先完成Kimi K3的极速适配与稳定拉起,验证了国产全功能GPU支撑万亿级大模型研发与工程落地的硬核实力,标志着国产算力与顶尖开源生态的深维协同进入新阶段。」

7月28日晚,月之暗面正式开源了其最新大模型Kimi K3,并同步发布了模型权重与技术报告。作为全球首个开源的3万亿级别大模型,Kimi K3拥有2.8万亿参数和100万token的上下文窗口,原生支持视觉理解能力。这一开源动作不仅刷新了开源大模型的规模纪录,也标志着Kimi系列模型在能力上达到了新的高度。

Kimi K3在架构设计上融合了多项创新技术,包括KDA混合线性注意力机制(Kimi Delta Attention)、注意力残差(Attention Residuals)、Gated MLA以及Stable LatentMoE等。这些技术专为长程编程、知识工作与复杂推理等前沿智能场景打造,旨在提升模型在处理超长序列和复杂任务时的效率与准确性。其中,KDA混合线性注意力机制通过引入Delta计算,有效降低了长序列下的计算复杂度,而注意力残差机制则增强了模型对关键信息的捕捉能力。

同日,摩尔线程官方宣布,基于其AI训推一体智算卡MTT S5000及MUSA软件栈,率先完成了Kimi K3的极速适配与稳定拉起。这一适配工作不仅展现了摩尔线程MUSA软件生态面向前沿超大规模模型的快速响应能力,也验证了国产全功能GPU在支撑万亿级大模型研发与工程落地方面的硬核实力。摩尔线程的MTT S5000智算卡专为AI训练和推理设计,配合MUSA软件栈,能够高效运行大规模深度学习模型。

此次Kimi K3与摩尔线程智算卡的全栈适配,是国产算力与开源大模型生态协同的重要里程碑。随着高性能国产算力与顶尖开源生态的深维协同,大模型产业正加速迈向高效、自主可控的软硬件全栈创新阶段。这一合作不仅为国内AI开发者提供了更强大的工具链,也为国产芯片在AI领域的应用树立了标杆。

从技术角度看,Kimi K3的开源和适配成功,意味着开发者可以在国产算力平台上直接使用这一顶级模型进行研究和应用开发。这对于推动国内AI技术的自主创新和生态建设具有重要意义。未来,随着更多类似合作的展开,国产算力与开源模型的结合将更加紧密,为AI产业的持续发展注入新动力。

# Kimi K3 # 摩尔线程 # 开源大模型 # 国产算力 # 全栈适配

来源:Heooo AI工具导航