技术进展

讯飞星火X2.5发布,MoE架构加持能力跃升

Heooo 09月07日18时33分 46 阅读

「科大讯飞发布星火X2.5大模型,采用MoE混合专家架构,参数规模达293B-A30B,重点提升代码与智能体能力,并基于国产算力实现全流程训练推理,同步开源两款端侧轻量化模型,支持百万级Token上下文。」

科大讯飞近日正式发布全新星火X2.5大模型,标志着其在底层技术架构与核心能力上迎来重要升级。该模型采用先进的MoE(混合专家)架构,参数规模达到293B-A30B,通过架构创新为复杂任务处理提供更强大的支撑。围绕这一架构,讯飞对代码编写和智能体应用开发能力进行了深度打磨与专项提升,同时持续强化数学逻辑推理与综合语义理解等通用能力。

在算力基础设施方面,星火X2.5实现了从训练到推理的全流程国产算力适配,基于我国自主可控的算力平台完成全部环节。针对国产超长序列在训练与推理中面临的技术难题,模型团队进行了持续攻关与优化,这使得该模型在长文本、高复杂度场景中的表现更加稳定可靠。目前,星火X2.5已正式上线讯飞开放平台,面向广大开发者和企业级用户全面开放,为行业应用提供新型基础能力。

除主打的大体量模型外,讯飞同步开源了星火X2.5-4B和1.7B两款端侧轻量化模型。这两款模型支持最长100万Token的超长上下文处理,可直接进行本地化部署,显著降低模型落地的资源门槛。它们尤其适合长文档深度处理、代码辅助开发以及复杂数据分析等多样化应用场景,有利于开发者在边缘设备或私有环境中快速构建智能化应用。

从此次发布可以看出,讯飞在兼顾前沿性能与国产化适配的同时,正通过开源轻量模型推动AI技术的广泛渗透。星火X2.5的架构升级与端侧开源并行,为国内大模型生态提供了更灵活的选择,也进一步丰富了开发者构建智能应用的路径。

# 讯飞星火 # MoE架构 # 端侧模型

来源:Heooo AI工具导航