【区角快讯】9月11日,中科曙光正式对外公布了其自主研发的scaleFabric Token加速技术体系。这一动作标志着国内首次实现了InfiniBand GPU直连异步技术(简称IBGDA)的规模化落地应用,打破了此前该领域长期由国际巨头主导的局面。
据中科曙光相关产品线负责人透露,scaleFabric的核心逻辑在于构建“算、存、传”三级紧密耦合的词元加速通道。通过在底层网络层面与计算单元、存储系统进行深度协同,该技术旨在大幅提升词元的吞吐效率。从大模型训练到推理,再到数据的存储复用,全链路的高速流转得以实现。这种低时延特性有效压缩了数据在多级网络中的传输耗时,使得IBGDA与存储直通带来的路径优化优势,能够进一步延伸至超大规模集群中,从而推动计算、存储与网络三者协同提升词元生成效率。
值得注意的是,在当前大模型推理逐渐占据主流的背景下,混合专家模型(MoE)架构已成为行业标配,这也让IBGDA技术的价值愈发凸显。在MoE复杂的通信场景中,IBGDA通过大幅减少CPU对关键通信路径的介入,显著提升了并行通信的效率。
回顾过往,国产RDMA网卡与GPU直通的落地案例可谓凤毛麟角,规模化部署更是难以企及。而目前,中科曙光自研的IBGDA技术已在十万卡级别的大规模集群中完成了严格验证,成功实现了该关键技术领域的国产补位。随着IBGDA进入规模化部署阶段,基于scaleFabric的词元加速体系有望进一步优化多卡间的数据交换效率,为混合专家模型等前沿架构提供新的高速互连选择,也为国产智算基础设施通过系统级优化提升整体性能提供了坚实支撑。
中科曙光发布scaleFabric体系,IBGDA技术实现十万卡级集群验证
科技区角
2026-09-11 17:01
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。