中国电信九月十七日放出了新一代星辰大模型Xing4.0-29B-A4B。总参数29B,激活参数只有4B,原生支持256K上下文,可扩展到512K。
官方给它标的定位是:国内第一个从训练芯片到推理部署全程国产、并且专门针对复杂工程任务打磨的百亿参数模型。
“全栈国产”这四个字在这儿不是形容词。昇腾芯片负责训练,国产框架做适配,架构自研,生态开源——从底层算力到上层工具链,整条链路不依赖海外供应链。在算力这个动不动被卡脖子的赛道上,把链路攥在自己手里,分量比单纯堆参数要重。
成绩方面,SuperCLUE评测里它的智能体能力拿到93.52分,排第三,和前两名的Qwen系模型差距都不到1分。一个总参数29B的模型贴到这个位置,说明架构上的取舍是奏效的。
对个人开发者最实在的是显存。4-bit量化后显存占用压到15GB,比FP16省了约75%,意味着一块24G的RTX 3090或4090这种消费级卡,就能在本地跑长上下文任务。不用堆服务器,不用租云卡。这个门槛一降,能用上它的人数量级就不一样了。
开源姿态也铺得比较满。微调支持LLaMA-Factory和MindFormers,推理适配SGLang、vLLM和KTransformers,智能体框架对OpenCode、Claude Code、OpenClaw、Hermes做了定向调优,把各家的格式规范对齐了。模型已陆续上线HuggingFace、GitHub、魔搭、Gitee和魔乐。
最后那条其实最费工夫。各家智能体框架的工具调用格式都不一样,模型不对齐就会出各种奇怪的解析错误,开发者一试不通就走了。愿意花力气做这些适配,说明它是奔着被人真用去的,不是发完权重就收工。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






中国电信开源Xing4.0-29B-A4B:一张4090就能跑256K上下文