中电信人工智能科技有限公司于2026年9月17日正式发布并开源星辰大模型Xing4.0-29B-A4B。该模型采用MoE架构,总参数29B、激活参数仅4B,原生支持256K上下文并可扩展至512K,是国内首个基于国产算力与国产框架完成训练的百亿参数大模型。目前,模型已上线GitHub、Hugging Face、Gitee、魔搭、魔乐等主流社区。
关于这枚模型的“国产成色”,官方口径将其定义为“国产算力+国产框架”。华为中国官方已确认,Xing4.0-29B-A4B基于昇腾Atlas 900 A3 SuperPoD液冷超节点与昇思MindSpore框架完成训练,训练性能提升96%。尽管官方新闻稿未直接点名昇腾芯片,但华为方面的确认让这条国产技术链路的全貌清晰起来:昇腾负责训练、国产框架做适配、架构自研、生态开源。
值得注意的是,原文表述中“国内第一个从训练芯片到推理部署全栈国产”的“第一个”提法,与官方口径“国内首个基于国产算力与国产框架完成训练的百亿参数大模型”存在微妙差异。以官方口径为准,该模型的“首个”标签锁定在“基于国产算力与国产框架完成训练”这一维度上,而非覆盖从芯片到推理的完整环节。
在SuperCLUE智能体评测中,Xing4.0-29B-A4B拿下93.52分,位列第3,与前两名的头部Qwen模型差距均不足1分。这个分数意味着,一个激活参数仅4B的“轻量级”选手,在工程任务上已经贴到了第一梯队的后背。
在更细分的工程能力测试中,该模型SWE-bench Verified得分75.0,Terminal-Bench 2.1得分57.5,均超过同尺寸竞品。模型面向智能体时代设计,聚焦任务规划、工具调用、自主执行等场景,适配框架方面,微调支持LLaMA-Factory、MindFormers;推理侧适配SGLang、vLLM、KTransformers;Agent框架针对OpenCode、Claude Code等做了定向调优。
模型在4-bit量化后显存占用约为15GB,RTX 3090/4090等24GB显存的消费级显卡即可本地运行。这对于需要处理长上下文任务又不想完全依赖云端算力的开发者来说,提供了一条低门槛路径。
开源策略上,模型同步上线GitHub、Hugging Face、Gitee、魔搭、魔乐等多个社区,覆盖国内外主流AI开发者阵地。可以推断,这种多平台分发思路意在降低获取门槛,加速社区生态的建立。
发布两天后,沐曦宣布其曦云C系列GPU率先完成对该模型的Day 0适配,进一步扩大了这颗国产模型在不同算力硬件上的可用范围。从底层算力到上层工具链,这条国产闭环的覆盖面正在逐步拓宽。