资讯
中科曙光发布scaleFabric Token加速技术体系
📋总体概括
中科曙光发布scaleFabric Token加速技术体系,在国内首次规模化应用IBGDA技术,允许GPU直接发起网络通信,省去CPU中转开销。该体系基于原生无损RDMA网络,构建「算存传」三级紧耦合的Token加速超级通道,已在十万卡级大规模集群中完成验证,并完成DeepEP等通信框架适配。这为国产大模型训练推理提供了自主可控的高速互连新选择,指向国产算力集群在scale-up/scale-out网络层面的实质性升级。
⚡关键信息
- ▸中科曙光发布scaleFabric Token加速技术体系,实现IBGDA技术在国内首次规模化应用
- ▸IBGDA支持GPU直接发起网络通信,绕过CPU中转,已在十万卡级大规模集群完成验证
- ▸体系以原生无损RDMA高速网络为基础,构建「算存传」三级紧耦合的Token加速超级通道
- ▸scaleFabric已完成DeepEP等主流通信框架适配,通过存储直通等技术提升Token流转效率
- ▸该体系为国产大模型提供新的高速互连选择,补齐国产算力集群网络短板
🔥犀利点评
十万卡级验证是这次发布真正值钱的数字——大模型训练的瓶颈早已不在单卡算力,而在卡间的Token流转效率,英伟达的NVLink+NVIDIA IRIS正是靠这一层卡住脖子。曙光把GPU直连网络的IBGDA落地并适配DeepEP,等于直接对准MoE训练的通信痛点,方向打得很准。但发布和规模化商用之间隔着软硬协同优化的深沟,真实集群中的稳定性、生态兼容度才是检验成色的试金石。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文 →