资讯🔥7.0
中科曙光发布词元加速技术体系:IBGDA十万卡级集群完成验证
📋总体概括
中科曙光9月11日发布scaleFabric Token词元加速技术体系,在国内率先实现IBGDA(InfiniBand GPU直连异步技术)规模化应用,该技术此前长期由国际厂商主导,国产RDMA网卡与GPU直通的落地案例极为罕见。scaleFabric通过构建算、存、传三级紧耦合的词元加速通道,实现词元在大模型训练、推理到存储复用全链路高速流转,并可减少CPU参与关键通信路径,提升MoE架构下的并行通信效率。自研IBGDA已在十万卡级大规模集群完成验证,为国产智算基础设施补上关键一环。
⚡关键信息
- ▸中科曙光发布scaleFabric Token加速技术体系,率先在国内规模化应用IBGDA技术
- ▸scaleFabric构建算存传三级紧耦合通道,覆盖训练、推理到存储复用的全链路词元流转
- ▸MoE已成大模型推理主流架构,IBGDA减少CPU参与关键通信路径,提升并行通信效率
- ▸此前IBGDA规模化落地由国际厂商主导,国产RDMA网卡与GPU直通落地案例极为罕见
- ▸自研IBGDA已在十万卡级大规模集群完成验证,实现该领域关键补位
🔥犀利点评
AI基础设施竞赛已从拼算力卡进入拼互连的下半场,GPU再强、网络喂不饱也是白搭,中科曙光这次卡位IBGDA算是对国产互连短板的关键一击。但「十万卡级完成验证」与大规模商用是两回事,验证环境和真实付费客户的严苛负载差距不小。而且IBGDA本质是英伟达的成熟技术路线,国产化是补课不是超越。宣传里没有具体性能数据对比,是真领先还是追平,还得看实测。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →