词元星火开源两款端侧大模型
「科大讯飞子公司词元星火推出并开源星火X2.5-4B和1.7B两款端侧通用大模型,原生支持100万Token上下文窗口,采用混合注意力架构,强化智能体、代码、数学等能力,面向车载与智能硬件场景,实现小模型高效处理超长文本。」
端侧人工智能正迎来性能与容量的双重突破。科大讯飞全资子公司词元星火正式宣布推出并开源两款全新的端侧通用大模型,分别为星火X2.5-4B和星火X2.5-1.7B。这两款模型突破了以往硬件算力的常见瓶颈,原生支持最长达到100万Token的超大上下文窗口。这一技术特性的落地,意味着体量更小的端侧设备也将具备处理超长文本、海量数据及复杂长周期任务的硬实力,为大模型在智能终端的深度普及与离线应用提供了更强劲的底层支撑。
在核心架构上,这两款模型采用了混合注意力架构,针对端侧部署场景进行了深度优化。官方表示,模型重点提升了智能体交互、数学计算、代码生成与指令遵循等核心能力,综合实测能力在同类端侧模型中处于领先水平。得益于百万级上下文窗口,用户可以在资源受限的设备上实现“读全书”式的大规模信息处理,例如一次性分析长篇文档、完整代码库或复杂的多轮对话历史,从而显著拓展端侧模型的应用边界。
从应用场景来看,星火X2.5系列主要面向车载系统、智能硬件以及万物互联等端侧环境。这类场景通常对响应速度、隐私安全和离线可用性有极高要求,而端侧大模型能够有效减少对云端服务的依赖,降低延迟并保障数据安全。开源策略进一步降低了开发者的接入门槛,词元星火同步开放了模型权重、代码仓库与部署文档,方便企业和个人开发者快速在目标硬件上进行适配和二次开发。
此次开源不仅展示了科大讯飞在端侧大模型领域的技术积累,也为整个AI开发者生态注入了新的活力。按照官方透露的计划,更大规模的模型将在后续发布,届时端侧模型的性能上限有望进一步提升。随着端侧算力持续升级与模型压缩技术的进步,大模型在移动设备上的全功能落地正在从理想走向现实,而星火X2.5系列开源模型将成为这一进程中的重要参考。
来源:Heooo AI工具导航