2026 年 9 月 22 日——硅基流动已在 SiliconCloud 平台上线中国电信开源的星辰大模型 Xing4.0-29B-A4B,并开放免费调用。该模型由中电信人工智能科技有限公司于 9 月 17 日正式发布并开源,总参数 29B、每 token 仅激活 4B,原生支持 256K 上下文长度(可扩展至 512K),是首个完全基于昇腾 NPU 平台与 MindSpore 框架训练的同规模开源模型。
Xing4.0 是中国电信 TeleChat(星辰)大模型系列的最新一代,定位面向智能体时代的轻量级代码智能体模型,从训练芯片到推理部署实现全栈国产:昇腾 910C 集群训练、MindSpore/MindFormers 框架适配、自研架构与开源生态完整链路。
1. 模型架构与规格
据模型官方仓库(GitHub:XingChen-AGI/Xing4.0-29B-A4B),模型基于 mHC + MLA + MTP 架构,面向多步规划、工具调用与复杂推理链执行优化;训练阶段通过细粒度 MoE 通信优化、选择性重计算、DVM 自动图算子融合与昇腾 C mHC 融合算子等手段,整体训练吞吐较开箱性能提升约 96%。
| 项目 | 数据 |
|---|---|
| 总参数量 | 29B |
| 激活参数量 | 4B/token |
| 架构 | mHC + MLA + MTP,64 路由专家 + 1 共享专家 |
| 层数 / 隐藏维度 | 40 层 / 3584 |
| 上下文长度 | 原生 256K,可扩展至 512K |
| 训练平台 | 昇腾 910C NPU + MindSpore |
| 训练吞吐提升 | 约 96%(较开箱性能) |
数据来源:模型官方仓库技术说明。
2. 评测表现
官方评测显示,Xing4.0-29B-A4B 在多项智能体基准上媲美 35B 级模型:SWE-bench Verified 达 75.0 分,接近 Qwen3.6-35B-A3B(76.0),显著高于 Gemma4-26B-A4B(53.0);Terminal-Bench 2.1 达 57.5 分,超过两款对比模型。
| 基准 | Xing4.0-29B-A4B | Qwen3.6-35B-A3B | Gemma4-26B-A4B |
|---|---|---|---|
| SWE-bench Verified | 75.0 | 76.0 | 53.0 |
| SWE-bench Multilingual | 66.0 | 67.2 | 51.0 |
| Terminal-Bench 2.1 | 57.5 | 51.5 | 30.0 |
| Claw-Eval | 76.55 | 74.54 | 71.49 |
| Tau3-Bench | 64.63 | 67.20 | 58.90 |
| AIME2026 | 90.0 | 92.7 | 88.3 |
| DeepresearchBII | 60.80 | 59.70 | 39.30 |
| IFBench | 69.67 | 65.50 | 72.67 |
数据来源:模型官方仓库评测报告,评测对象为同一开源版本。
3. 上线与获取方式
据硅基流动平台消息,Xing4.0-29B-A4B 已上线 SiliconCloud 并开放免费调用,开发者注册后即可通过 OpenAI 兼容接口调用。此前该模型已于 9 月 17 日同步开源至 GitHub、HuggingFace、魔搭 ModelScope、Gitee、魔乐社区等平台,并同日开源 FP8 与 GGUF 量化版本;据媒体报道,4bit 量化后权重约 15GB,单张消费级显卡 RTX 4090 即可本地运行。
部署方面,模型已向 vLLM、SGLang、KTransformers、TensorRT-LLM、llama.cpp 提交支持代码(部分合并中),支持 LLaMA-Factory 与 MindFormers 微调,并针对 OpenCode、Claude Code、OpenClaw、Hermes 等智能体框架完成适配。
举手提问