2026 年 9 月 22 日——硅基流动已在 SiliconCloud 平台上线中国电信开源的星辰大模型 Xing4.0-29B-A4B,并开放免费调用。该模型由中电信人工智能科技有限公司于 9 月 17 日正式发布并开源,总参数 29B、每 token 仅激活 4B,原生支持 256K 上下文长度(可扩展至 512K),是首个完全基于昇腾 NPU 平台与 MindSpore 框架训练的同规模开源模型。

Xing4.0 是中国电信 TeleChat(星辰)大模型系列的最新一代,定位面向智能体时代的轻量级代码智能体模型,从训练芯片到推理部署实现全栈国产:昇腾 910C 集群训练、MindSpore/MindFormers 框架适配、自研架构与开源生态完整链路。

1. 模型架构与规格

据模型官方仓库(GitHub:XingChen-AGI/Xing4.0-29B-A4B),模型基于 mHC + MLA + MTP 架构,面向多步规划、工具调用与复杂推理链执行优化;训练阶段通过细粒度 MoE 通信优化、选择性重计算、DVM 自动图算子融合与昇腾 C mHC 融合算子等手段,整体训练吞吐较开箱性能提升约 96%。

项目 数据
总参数量 29B
激活参数量 4B/token
架构 mHC + MLA + MTP,64 路由专家 + 1 共享专家
层数 / 隐藏维度 40 层 / 3584
上下文长度 原生 256K,可扩展至 512K
训练平台 昇腾 910C NPU + MindSpore
训练吞吐提升 约 96%(较开箱性能)

数据来源:模型官方仓库技术说明。

2. 评测表现

官方评测显示,Xing4.0-29B-A4B 在多项智能体基准上媲美 35B 级模型:SWE-bench Verified 达 75.0 分,接近 Qwen3.6-35B-A3B(76.0),显著高于 Gemma4-26B-A4B(53.0);Terminal-Bench 2.1 达 57.5 分,超过两款对比模型。

基准 Xing4.0-29B-A4B Qwen3.6-35B-A3B Gemma4-26B-A4B
SWE-bench Verified 75.0 76.0 53.0
SWE-bench Multilingual 66.0 67.2 51.0
Terminal-Bench 2.1 57.5 51.5 30.0
Claw-Eval 76.55 74.54 71.49
Tau3-Bench 64.63 67.20 58.90
AIME2026 90.0 92.7 88.3
DeepresearchBII 60.80 59.70 39.30
IFBench 69.67 65.50 72.67

数据来源:模型官方仓库评测报告,评测对象为同一开源版本。

3. 上线与获取方式

据硅基流动平台消息,Xing4.0-29B-A4B 已上线 SiliconCloud 并开放免费调用,开发者注册后即可通过 OpenAI 兼容接口调用。此前该模型已于 9 月 17 日同步开源至 GitHub、HuggingFace、魔搭 ModelScope、Gitee、魔乐社区等平台,并同日开源 FP8 与 GGUF 量化版本;据媒体报道,4bit 量化后权重约 15GB,单张消费级显卡 RTX 4090 即可本地运行。

部署方面,模型已向 vLLM、SGLang、KTransformers、TensorRT-LLM、llama.cpp 提交支持代码(部分合并中),支持 LLaMA-Factory 与 MindFormers 微调,并针对 OpenCode、Claude Code、OpenClaw、Hermes 等智能体框架完成适配。