中国电信开源 Xing4.0-29B-A4B:29B 总参数、4B 激活参数,主打国产全栈与长上下文智能体
据 IT之家 9 月 19 日消息,中国电信已于 9 月 17 日发布新一代星辰大模型 Xing4.0-29B-A4B,并上线开源社区。来源显示,该模型总参数量为 29B,激活参数仅 4B,原生支持 256K 上下文,并可扩展至 512K。官方将其定位为国内首个基于国产算力与国产框架完成训练、并针对复杂工程任务深度优化的百亿参数大模型,重点强调从训练芯片、框架适配到推理部署的全栈国产路径。
从产品定位看,Xing4.0-29B-A4B 并不是单纯追求参数规模的通用模型,而是更强调轻量化、长上下文和智能体任务能力的组合。对于开发者和企业用户来说,这类模型的价值在于:既要能处理较长代码、文档、工程上下文,又要降低本地部署和推理成本,从而更容易进入真实研发、运维和自动化工作流。
29B 总参数、4B 激活参数:轻量化是核心卖点
来源摘要显示,Xing4.0-29B-A4B 的总参数量为 29B,但单次推理激活参数为 4B。这意味着它在保持较大模型容量的同时,试图通过稀疏激活等架构思路降低实际推理负担。官方还表示,模型在 4-bit 量化后显存占用可降至 15GB,相比 FP16 节省约 75%,RTX 3090、RTX 4090 等 24G 消费级显卡即可在本地运行长上下文任务。
对中文 AI 开发者而言,这一点值得关注。过去,长上下文模型常常伴随较高显存门槛,很多团队需要依赖云端高端 GPU 才能测试较复杂的智能体应用。如果 24G 显存消费级显卡即可运行较长上下文任务,模型在个人开发者、小团队原型验证、私有化测试场景中的可用性会更高。
- 参数配置:总参数量 29B,激活参数 4B。
- 上下文能力:原生支持 256K,上下文可扩展至 512K。
- 部署门槛:4-bit 量化后显存占用降至 15GB。
- 生态兼容:适配多类微调、推理和 Agent 框架。
全栈国产路线:从昇腾训练到国产框架适配
中国电信官方强调,Xing4.0-29B-A4B 从训练芯片到推理部署均走通国产链路,包括昇腾训练、国产框架适配、自研架构和开源生态。这一表述背后,是国内大模型产业在算力供应、训练框架、推理工具和应用落地之间寻求更高自主性的趋势。
来源称,该模型已对主流开源生态做了兼容,支持 LLaMA-Factory、MindFormers 等微调架构,并适配 SGLang、vLLM、KTransformers 等推理框架。在智能体方向,模型还对 OpenCode、Claude Code、OpenClaw、Hermes 等 Agent 框架进行了定向适配调优,以对齐相关格式规范。
这种兼容策略对于开源模型很关键。模型本身能力是一方面,能否接入现有微调工具、推理引擎和 Agent 框架,决定了开发者是否能快速完成评测、微调、部署和应用集成。尤其在企业场景中,生态适配往往比单项榜单成绩更直接影响采用成本。
影响与解读:国产长上下文智能体模型进入可部署竞争阶段
从 SuperCLUE 评测结果看,来源显示 Xing4.0-29B-A4B 在智能体能力方面得分 93.52,排名第 3,与两款头部 Qwen 模型的差距均不足 1 分。虽然单一评测不能完全代表真实生产表现,但该成绩至少说明,轻量化模型在 Agent 能力上正在接近头部开源模型梯队。
更重要的是,Xing4.0-29B-A4B 把几个产业关注点放在了同一套方案中:国产算力训练、长上下文处理、消费级显卡本地部署,以及对 Agent 工具链的兼容。对于需要代码理解、文档检索、自动化执行、复杂工程任务拆解的场景,这类模型有机会成为企业私有化智能体底座的候选项。
当然,模型开源只是第一步。后续仍需观察其在真实代码仓库、多轮工具调用、低显存长上下文稳定性、中文企业知识库问答等场景中的表现。对开发者而言,Xing4.0-29B-A4B 的发布提供了一个新的国产全栈模型样本,也进一步推动国内开源大模型从“能跑”走向“更易部署、更适合工程化智能体应用”。