中国电信开源Xing4.0-29B-A4B:全栈国产百亿参数智能体模型落地
摘要
中国电信发布新一代星辰大模型Xing4.0-29B-A4B,总参数量29B、激活参数4B,原生支持256K上下文,为国内首个全栈国产算力与框架训练的百亿参数大模型,SuperCLUE智能体评测得分93.52位列第三。
9月17日,中国电信正式推出新一代星辰大模型Xing4.0-29B-A4B,并于9月19日对外披露细节。该模型总参数量29B,激活参数仅4B,原生支持256K上下文窗口,可进一步扩展至512K。官方将其定位为国内首个完全依托国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。
从训练到部署,Xing4.0-29B-A4B实现了全链路国产化:训练环节采用昇腾芯片,框架层完成国产适配,模型架构为自研设计,并延续星辰系列的开源策略。这一路径意味着从底层芯片到上层应用生态,不再依赖海外技术栈。
性能方面,在SuperCLUE评测的智能体能力维度中,Xing4.0-29B-A4B得分93.52,排名第三,与两款头部Qwen模型的差距均不足1分。工程落地层面,该模型经4-bit量化后显存占用降至15GB,较FP16节省约75%,RTX 3090、RTX 4090等24G消费级显卡即可本地运行长上下文任务。
生态兼容性上,Xing4.0-29B-A4B支持LLaMA-Factory、MindFormers等微调架构,适配SGLang、vLLM、KTransformers等主流推理框架。Agent框架方面,对OpenCode、Claude Code、OpenClaw、Hermes进行了定向适配调优,深度对齐各框架格式规范。目前该模型已上线开源社区。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗