产业观察🔥7.0
中国电信开源首个全栈国产轻量级智能体大模型 Xing4.0-29B-A4B
📋总体概括
中国电信9月17日发布并开源星辰大模型Xing4.0-29B-A4B,总参数量29B、激活参数仅4B,原生支持256K上下文可扩展至512K,号称国内首个基于昇腾算力与国产框架全栈训练的百亿级大模型。SuperCLUE智能体能力得分93.52、位列第三,与头部Qwen模型差距不足1分。经4-bit量化后显存占用仅15GB,RTX 3090/4090等24G消费级显卡即可本地部署,并兼容LLaMA-Factory、vLLM、SGLang等主流开源生态,主打国产化与工程实用性。
⚡关键信息
- ▸Xing4.0-29B-A4B总参数量29B、激活参数仅4B,是国内首个全栈国产(昇腾训练+国产框架)完成的百亿参数大模型
- ▸原生支持256K上下文,可扩展至512K,面向复杂工程任务与智能体场景深度优化
- ▸SuperCLUE智能体能力得分93.52位列第3名,与两款头部Qwen模型差距均不足1分
- ▸4-bit量化后显存占用降至15GB(较FP16省约75%),24G消费级显卡可本地跑长上下文
- ▸兼容LLaMA-Factory、MindFormers微调框架及vLLM、SGLang等主流推理框架,延续开源路线
🔥犀利点评
运营商做AI大模型,最怕沦为PPT工程,但这次中国电信交出的成绩单有点东西:激活4B的小钢炮设计+全栈国产训练,戳中了信创市场最痛的需求点。93.52分与Qwen差距不足1分固然有评测口径的水分,但昇腾全流程跑通本身就是稀缺样本。消费级显卡可部署更是务实之举——国产模型不该只活在机房里。真正的考验在开源后的社区活跃度和实际落地,而非榜单名次。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →