返回热力追踪
关键Model Opensource

中国电信开源全栈国产百亿参数大模型Xing4.0-29B-A4B,单张3090可本地运行

中国电信于9月17日发布并开源新一代星辰大模型Xing4.0-29B-A4B,这是国内首个基于国产算力与国产框架训练、面向复杂工程任务优化的百亿参数大模型。该模型采用MoE架构,总参数量29B,激活参数仅4B,原生支持256K上下文,4-bit量化后显存占用仅15GB,消费级显卡即可本地部署。

编辑视角

该模型实现了全链路国产化适配,降低了企业本地部署大模型的算力门槛,满足数据不出域的需求,对国内企业落地AI办公具有实用价值,值得关注。

深度解读

主旨:中国电信开源全栈国产化适配的百亿参数轻量级智能体大模型,瞄准企业数据不出域、低算力本地部署AI办公的需求。证据:官方公开开源信息,多家媒体证实模型参数、显存占用、国产化适配细节,实测单张RTX 3090可流畅运行,兼容主流Agent框架,沐曦GPU完成Day 0适配,llama.cpp社区也已提供支持。边界:目前仅公开模型参数与基础适配信息,尚未看到大规模企业落地案例,实际生产环境的稳定性与效果仍需验证;MoE架构的激活效率、长上下文处理的实际体验也需要更多用户测试反馈。后续观察点:该模型在企业实际办公场景的效果、更多国产硬件厂商的适配进展、基于该模型开发的AI办公应用生态。

核心要点
  • 中国电信发布并开源全栈国产百亿参数大模型Xing4.0-29B-A4B
  • 模型采用MoE架构,4-bit量化后仅需15GB显存,单张3090可本地运行
  • 全链路国产化适配,基于昇腾芯片与国产框架完成训练
  • 原生支持256K上下文,兼容主流Agent框架,满足企业数据不出域需求