中国电信开源全栈国产智能体大模型

中国电信9月17日发布星辰大模型Xing4.0-29B-A4B,总参29B、激活仅4B,基于国产算力与框架训练,已上线开源社区。

中国电信9月17日发布新一代星辰大模型Xing4.0-29B-A4B。官方介绍,该模型总参数量29B、激活参数仅4B,原生支持256K上下文、可扩展至512K,是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。

从训练芯片到推理部署,Xing4.0走的是”全栈国产”路线:昇腾训练、国产框架适配、自研架构、开源生态一条路打通。在SuperCLUE智能体能力评测中,该模型得分93.52,位列第3,与两款头部Qwen模型的差距不足1分,说明国产模型在智能体方向上的追赶已经相当接近。

更贴近开发者的是部署成本。模型经4-bit量化后显存占用降至15GB,较FP16节省约75%,RTX 3090、RTX 4090这类消费级显卡就能本地跑长上下文任务。它延续星辰的开源路线,兼容LLaMA-Factory、MindFormers等微调架构,适配SGLang、vLLM、KTransformers等推理框架,并对OpenCode、Claude Code等Agent框架做了定向调优。

对国产AI生态来说,一个能在消费级显卡上跑、且训练链路自主可控的模型,降低了企业与个人试用、微调的门槛。中国电信将Xing4.0-29B-A4B已上线HuggingFace、GitHub、魔搭、Gitee、魔乐等开源社区,意味着后续会有更多基于它的二次开发。

信息来源:中国电信(据IT之家报道)

本文仅供信息参考,不构成任何投资建议。

上一篇 2026年9月22日 18:46
下一篇 2026年9月22日 18:46

相关推荐