大模型从实验室走向产业落地,行业逐渐意识到算力不等于产出。中科曙光近日发布scaleFabric Token加速技术体系,实现IBGDA技术国内首次规模化落地。这项技术通过打通算力、存储和网络的数据流转瓶颈,让大模型真正释放算力价值。
在AI集群中,Token生成效率不仅取决于GPU算力,更取决于数据流转效率。训练时多卡同步更新参数,推理时KV缓存跨卡搬运,海量数据在GPU间传递成为关键挑战。中科曙光工程师指出,网络与存储时延往往成为限制集群性能的短板,传统路径中数据需在存储、内存、显存间多次拷贝,导致GPU空转等待。
scaleFabric构建"算存传"三级加速通道,覆盖训练、推理、存储复用全链路。其中IBGDA技术让GPU直接驱动InfiniBand网卡,无需依赖CPU管理通信。这项技术已在国内十万卡级集群验证,相比主流方案降低63%三跳时延,让大模型训练效率提升30%-60%。
国产技术突破正在改写AI基础设施格局。中科曙光通过开放架构兼容多种国产算力卡,为AI底层生态提供支撑。从单卡算力比拼转向全链路协同优化,国产高速网络技术正推动大模型应用迈入新阶段。