资讯

中科曙光发布词元加速技术体系:IBGDA十万卡级集群完成验证

驱动之家·2026/9/11 08:39:00🔗 原文

📋总体概括

中科曙光9月11日发布scaleFabric Token加速技术体系,率先在国内实现IBGDA(InfiniBand GPU直连异步技术)规模化应用,该技术已在十万卡级大规模集群中完成验证。scaleFabric构建算、存、传三级紧耦合的词元加速通道,打通大模型训练、推理到存储复用的全链路高速流转;在MoE成为主流架构背景下,通过减少CPU参与关键通信路径大幅提升并行通信效率,填补国产RDMA网卡与GPU直通规模化落地的空白,为国产智算基础设施提供新的高速互连选择。

关键信息

  • 中科曙光发布scaleFabric Token加速技术体系,国内率先实现IBGDA技术规模化应用
  • 自研IBGDA已在十万卡级大规模集群完成验证,此前该领域长期由国际厂商主导
  • scaleFabric构建算存传三级紧耦合词元加速通道,实现训练、推理到存储复用全链路高速流转
  • MoE架构下IBGDA通过减少CPU参与关键通信路径,大幅提升并行通信效率
  • 国产RDMA网卡与GPU直通落地案例此前极为罕见,此次实现关键补位

🔥犀利点评

十万卡级验证听着唬人,但先问一句:验证不等于商用跑通,性能数据、与英伟达NVLink/IB生态的差距,曙光一个都没给。MoE确实把All-to-All通信变成瓶颈,IBGDA方向没错,可国产互连的真正考题是生态——没有主流框架和上层软件的原生适配,再漂亮的架构也是孤岛。这次更多是填补从0到1的姿态意义,离替代还差着量级。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文