资讯

中科曙光发布scaleFabric Token加速技术体系

36氪快讯·2026/9/11 06:13:33🔗 原文

📋总体概括

中科曙光发布scaleFabric Token加速技术体系,在国内首次规模化应用IBGDA技术,允许GPU直接发起网络通信,省去CPU中转开销。该体系基于原生无损RDMA网络,构建「算存传」三级紧耦合的Token加速超级通道,已在十万卡级大规模集群中完成验证,并完成DeepEP等通信框架适配。这为国产大模型训练推理提供了自主可控的高速互连新选择,指向国产算力集群在scale-up/scale-out网络层面的实质性升级。

关键信息

  • 中科曙光发布scaleFabric Token加速技术体系,实现IBGDA技术在国内首次规模化应用
  • IBGDA支持GPU直接发起网络通信,绕过CPU中转,已在十万卡级大规模集群完成验证
  • 体系以原生无损RDMA高速网络为基础,构建「算存传」三级紧耦合的Token加速超级通道
  • scaleFabric已完成DeepEP等主流通信框架适配,通过存储直通等技术提升Token流转效率
  • 该体系为国产大模型提供新的高速互连选择,补齐国产算力集群网络短板

🔥犀利点评

十万卡级验证是这次发布真正值钱的数字——大模型训练的瓶颈早已不在单卡算力,而在卡间的Token流转效率,英伟达的NVLink+NVIDIA IRIS正是靠这一层卡住脖子。曙光把GPU直连网络的IBGDA落地并适配DeepEP,等于直接对准MoE训练的通信痛点,方向打得很准。但发布和规模化商用之间隔着软硬协同优化的深沟,真实集群中的稳定性、生态兼容度才是检验成色的试金石。

本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文