中国电信开源星辰大模型Xing4.0-29B-A4B:全栈国产,消费级显卡可跑

中电信人工智能科技有限公司于2026年9月17日正式发布并开源星辰大模型Xing4.0-29B-A4B。该模型采用MoE架构,总参数29B、激活参数仅4B,原生支持256K上下文并可扩展至512K,是国内首个基于国产算力与国产框架完成训练的百亿参数大模型。目前,模型已上线GitHub、Hugging Face、Gitee、魔搭、魔乐等主流社区。

全栈国产链路:昇腾算力与MindSpore框架的组合

关于这枚模型的“国产成色”,官方口径将其定义为“国产算力+国产框架”。华为中国官方已确认,Xing4.0-29B-A4B基于昇腾Atlas 900 A3 SuperPoD液冷超节点与昇思MindSpore框架完成训练,训练性能提升96%。尽管官方新闻稿未直接点名昇腾芯片,但华为方面的确认让这条国产技术链路的全貌清晰起来:昇腾负责训练、国产框架做适配、架构自研、生态开源。
值得注意的是,原文表述中“国内第一个从训练芯片到推理部署全栈国产”的“第一个”提法,与官方口径“国内首个基于国产算力与国产框架完成训练的百亿参数大模型”存在微妙差异。以官方口径为准,该模型的“首个”标签锁定在“基于国产算力与国产框架完成训练”这一维度上,而非覆盖从芯片到推理的完整环节。

智能体能力紧贴第一梯队

在SuperCLUE智能体评测中,Xing4.0-29B-A4B拿下93.52分,位列第3,与前两名的头部Qwen模型差距均不足1分。这个分数意味着,一个激活参数仅4B的“轻量级”选手,在工程任务上已经贴到了第一梯队的后背。
在更细分的工程能力测试中,该模型SWE-bench Verified得分75.0,Terminal-Bench 2.1得分57.5,均超过同尺寸竞品。模型面向智能体时代设计,聚焦任务规划、工具调用、自主执行等场景,适配框架方面,微调支持LLaMA-Factory、MindFormers;推理侧适配SGLang、vLLM、KTransformers;Agent框架针对OpenCode、Claude Code等做了定向调优。

消费级显卡本地运行与生态开放

模型在4-bit量化后显存占用约为15GB,RTX 3090/4090等24GB显存的消费级显卡即可本地运行。这对于需要处理长上下文任务又不想完全依赖云端算力的开发者来说,提供了一条低门槛路径。
开源策略上,模型同步上线GitHub、Hugging Face、Gitee、魔搭、魔乐等多个社区,覆盖国内外主流AI开发者阵地。可以推断,这种多平台分发思路意在降低获取门槛,加速社区生态的建立。
发布两天后,沐曦宣布其曦云C系列GPU率先完成对该模型的Day 0适配,进一步扩大了这颗国产模型在不同算力硬件上的可用范围。从底层算力到上层工具链,这条国产闭环的覆盖面正在逐步拓宽。

参考资料

  1. 首个全栈国产轻量级智能体大模型Xing4.0-29B正式发布 - 中国电信集团有限公司
  2. 中国电信开源 Xing4.0-29B-A4B: 从昇腾芯片到框架全栈国产 , 消费级显卡也能跑长上下文_ZAKER新闻 - ZAKER
  3. 中国电信开源全栈国产轻量级星辰大模型 Xing4.0-29B-A4B - AI - 光通信Pro - C114
  4. 中国电信星辰Xing4.0-29B-A4B全栈国产:轻量化设计让消费级显卡畅跑复杂任务_模型_OpenCode_技术 - 手机搜狐网
  5. 今日AI圈值得关注的动态 2026年9月18日_IT互联网_什么值得买 - 什么值得买社区频道
  6. 国产算力新里程碑!曦云C系列GPU率先完成中国电信星辰Xing4.0大模型Day 0适配_ZAKER新闻 - ZAKER
  7. 华为:基于昇腾超节点训练的星辰轻量级代码智能体大模型 Xing4.0-29B 发布 - 同花顺财经
  8. 「纯血」国产轻量级智能体大模型开源“星辰”Xing4.0-2 中电信人工智能科技有限公司开源 Xing4.0-29B-A4B:基于国产算力与国产框架训练的全栈国产化轻量级智能体大模型,昇腾训练、精度误差仅千分之二,4-bit 量化后一张消费级显卡就能跑 - 腾讯网
  9. 29B 的模型只要 4B 激活:中国电信 Xing4.0 的本地长上下文账_AI_KIO no way-鲲鹏昇腾开发者社区 - 鲲鹏昇腾开发者社区
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。