资讯
中科曙光发布词元加速技术体系:IBGDA十万卡级集群完成验证
📋总体概括
中科曙光9月11日发布scaleFabric Token加速技术体系,率先在国内实现IBGDA(InfiniBand GPU直连异步技术)规模化应用,该技术已在十万卡级大规模集群中完成验证。scaleFabric构建算、存、传三级紧耦合的词元加速通道,打通大模型训练、推理到存储复用的全链路高速流转;在MoE成为主流架构背景下,通过减少CPU参与关键通信路径大幅提升并行通信效率,填补国产RDMA网卡与GPU直通规模化落地的空白,为国产智算基础设施提供新的高速互连选择。
⚡关键信息
- ▸中科曙光发布scaleFabric Token加速技术体系,国内率先实现IBGDA技术规模化应用
- ▸自研IBGDA已在十万卡级大规模集群完成验证,此前该领域长期由国际厂商主导
- ▸scaleFabric构建算存传三级紧耦合词元加速通道,实现训练、推理到存储复用全链路高速流转
- ▸MoE架构下IBGDA通过减少CPU参与关键通信路径,大幅提升并行通信效率
- ▸国产RDMA网卡与GPU直通落地案例此前极为罕见,此次实现关键补位
🔥犀利点评
十万卡级验证听着唬人,但先问一句:验证不等于商用跑通,性能数据、与英伟达NVLink/IB生态的差距,曙光一个都没给。MoE确实把All-to-All通信变成瓶颈,IBGDA方向没错,可国产互连的真正考题是生态——没有主流框架和上层软件的原生适配,再漂亮的架构也是孤岛。这次更多是填补从0到1的姿态意义,离替代还差着量级。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →