供应链
国产算力新里程碑!曦云C系列GPU率先完成中国电信星辰Xing4.0大模型Day 0适配
📋总体概括
中国电信旗下中电信人工智能科技发布新一代星辰大模型Xing4.0-29B-A4B,采用MOE架构,总参数量29B、激活参数仅4B,原生支持256K上下文,主打代码智能体能力。沐曦股份宣布依托自研MXMACA软件栈,曦云C系列GPU率先完成该模型Day 0适配,实现上线即适配。该模型是国内首个基于国产算力与国产框架完成训练的百亿参数大模型,在SWE-bench Verified得分75.0、Terminal-Bench 2.1得分57.5,超过同尺寸竞品,被视为国产算力软硬件协同的标志性进展。
⚡关键信息
- ▸中电信发布星辰大模型Xing4.0-29B-A4B,MOE架构总参数29B、激活仅4B,面向智能体时代
- ▸模型原生支持256K上下文,可扩展至512K,聚焦任务规划、工具调用和自主执行
- ▸沐曦曦云C系列GPU依托自研MXMACA软件栈率先完成Day 0适配,实现上线即适配
- ▸该模型是国内首个基于国产算力与国产框架完成训练的百亿参数大模型
- ▸SWE-bench Verified得分75.0,Terminal-Bench 2.1得分57.5,均超同尺寸竞品
🔥犀利点评
Day 0适配比模型性能更值得关注——国产GPU真正的瓶颈从来不是算力纸面参数,而是CUDA生态墙。沐曦能和电信大模型发布当天就完成适配,说明MXMACA软件栈已具备快速跟进主流模型的能力,这才是生态成熟度的信号。当然MoE架构激活参数只有4B,对算力要求天然宽松,这个首发的含金量要打折扣看,别急着吹里程碑。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →