华为发布灵衢互联新架构 破解万亿参数大模型算力瓶颈

在华为全联接大会2026上,华为常务董事杨超斌首次公开灵衢互联架构,宣布推出系列化算力底座。传统计算架构下,十万卡集群算力利用率仅20%,大量算力在等待通信完成。10T参数大模型训练时,单卡显存已无法承载海量中间数据,Agent与模型每小时交互数百次,产生远超内存容量的KV Cache。
首页 新闻资讯 行业资讯 光通信 华为发布灵衢互联新架构 破解万亿参数大模型算力瓶颈

在华为全联接大会2026上,华为常务董事杨超斌首次公开灵衢互联架构,宣布推出系列化算力底座。传统计算架构下,十万卡集群算力利用率仅20%,大量算力在等待通信完成。10T参数大模型训练时,单卡显存已无法承载海量中间数据,Agent与模型每小时交互数百次,产生远超内存容量的KV Cache。

华为通过灵衢互联技术,构建集群与超节点协同的新计算架构。该架构具备四大核心特征:统一互联协议将带宽提升至TB级,时延压缩至2微秒;CPU/NPU等算力单元实现平等访问,支持灵活配比;混合介质资源池化解决激活值缓存问题,降低大模型训练对显存依赖;光电互联技术打造超低时延数据通道。

华为推出三级互联设备体系,覆盖柜内、跨柜与集群场景。柜内刀片实现零电缆损耗,单个超节点可省196公里铜缆;跨柜设备单端口达1.6T,单机实现280T全光互联;UBG交换机支持百万卡集群,满足模型参数向几十万亿演进需求。配套发布的Agentic AI超节点集群,整合鲲鹏950、昇腾960等算力单元,实现资源池化与协同。

灵衢技术已延伸至一体机领域,推出1卡到8卡系列化产品。Atlas 650E通过双机直连实现16个NPU免交换互联,形成小型超节点。生态方面,华为联合50+客户共建26个行业算子库,与90+开源社区合作,加速Agent开发进程。杨超斌表示,华为将通过系统级创新,为全球提供新选择。

华为通过灵衢互联技术,为AI算力瓶颈提供新解,推动行业智能化升级。