行业资讯

科大讯飞开源端侧百万Token上下文模型

Heooo 09月01日17时02分 4 阅读

「科大讯飞词元星火正式开源星火X2.5-4B和1.7B两款端侧大模型,原生支持100万Token上下文,采用混合注意力架构,基于全国产算力训练,在智能体、代码、数学等能力上优化。两款模型在售后与办公场景表现亮眼,支持多硬件平台与推理框架,即日起开放权重及API限时免费。」

科大讯飞旗下词元星火近日宣布推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。这两款模型原生支持最长100万Token的上下文窗口,是目前端侧模型中唯一支持该量级上下文的产品,为开发者提供了在本地设备上处理超长文本的全新可能。

在技术架构上,两款模型均采用混合注意力架构,并围绕智能体、代码、数学和指令遵循等核心能力进行深度优化。模型基于全国产算力平台完成全流程训练,使用约20万亿Token的多样化数据进行预训练,兼顾了性能与可控性。

从实际应用场景来看,星火X2.5系列展现出较强的实用性。以产品售后场景为例,用户可将完整售后手册导入模型,针对“购买10天后设备故障且使用过第三方耗材”这类复杂问题,模型能够关联跨章节规定给出综合判断,并在新增条件下保持前文情境持续提供建议。在个人办公场景中,星火X2.5-4B可完成从原始数据分析到双语报告交付的全流程,显著提升工作效率。

在智能家居和机器人控制领域,模型同样表现不俗。在Domux智能家居测试集上,星火X2.5-1.7B的控制指令端到端执行正确率达到90.3%,平均响应时间仅为0.85秒。模型还适用于机器人操作控制、目标追踪、导航决策等场景,可灵活部署于机器人本体或边缘设备,满足低延迟、高可靠性的要求。

生态兼容性方面,星火X2.5-4B和1.7B支持英伟达、华为、海光及后摩等硬件平台,并兼容vLLM、SGLang、llama.cpp等主流推理框架。开发者可通过Ollama、LM Studio等工具快速完成本地部署。即日起,模型权重已在Hugging Face、GitHub等平台开放,对应的API也已上线讯飞星辰MaaS平台,并限时免费提供。

按照官方规划,科大讯飞将于后续正式发布星火X2.5-293B通用大模型,进一步升级代码和智能体等核心能力。这一系列动作表明,科大讯飞正在加速构建从端侧到云端的全尺寸模型矩阵,推动AI技术在更多真实场景中落地。

# 科大讯飞 # 端侧模型 # 开源 # 大模型 # 百万Token

来源:Heooo AI工具导航