中国电信开源全栈国产轻量级智能体大模型
「中国电信发布并开源新一代星辰大模型 Xing4.0-29B-A4B,总参数量 29B、激活参数仅 4B,原生支持 256K 上下文并可扩展至 512K,是国内首个基于国产算力与国产框架完成训练的百亿参数大模型。其在 SuperCLUE 智能体评测中得分 93.52,位列第三。」
中国电信正式发布新一代星辰大模型 Xing4.0-29B-A4B,并同步在 HuggingFace 与魔搭社区开源。该模型总参数量为 29B,激活参数仅 4B,原生支持 256K 上下文长度,并可进一步扩展至 512K,面向复杂工程任务做了深度优化。
官方表示,Xing4.0-29B-A4B 是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。从训练芯片到推理部署,整条链路实现全栈国产:昇腾负责训练,国产框架完成适配,模型采用自研架构,最终回到开源生态,一条路走通。
评测数据方面,在 SuperCLUE 的智能体能力评测中,Xing4.0-29B-A4B 得分 93.52,位列第 3 名,与两款头部 Qwen 模型的差距均不足 1 分。这意味着在智能体这一当前最受关注的模型能力方向上,该模型已经进入第一梯队的追赶区间。
轻量化是这款模型的另一大看点。经 4 比特量化后,其显存占用可降低至 15GB,相比 FP16 节省约 75%。这意味着 RTX 3090、RTX 4090 这类 24G 显存的消费级显卡,就能在本地跑起长上下文任务,大幅拉低了部署门槛,对个人开发者和小型团队的私有化落地相当友好。
在生态兼容性上,Xing4.0-29B-A4B 延续星辰大模型的开源路线,对主流开源生态做了全面兼容:微调侧支持 LLaMA-Factory、MindFormers 等架构;推理侧适配 SGLang、vLLM、KTransformers 等主流框架;Agent 框架则对 OpenCode、Claude Code、OpenClaw、Hermes 做了定向适配调优,并深度对齐各框架的格式规范。
目前,星辰大模型 Xing4.0-29B-A4B 已上线开源社区,开发者可在 HuggingFace 与魔搭平台获取模型权重并直接开展微调与推理验证。
来源:Heooo AI工具导航