在华为全联接大会2026期间,华为常务董事、ICT BG CEO杨超斌发表主题演讲,围绕计算架构创新,系统阐释了灵衢互联架构,并宣布推出基于灵衢互联架构的系列化算力底座,持续提升生态能力,使能客户、伙伴与开发者应用创新。

华为常务董事、ICT BG CEO杨超斌发表主题演讲
在传统计算架构下,集群规模扩大时,资源利用率反而下降,十万卡集群的实际模型算力利用率仅约20%,大量算力处于等待通信完成的状态。10T参数大模型的训练需要海量中间数据,单张显卡的内存容量已难以承载。同时,Agent与模型每小时交互可达数百次,需要CPU与NPU算力灵活配置与协同,产生的KV Cache也远超内存容量,必须依靠跨系统、跨层级存储。集群内不同部件之间的互联与通信能力,已成为决定计算系统性能的关键。
为此,华为以灵衢互联为核心,打造集群与超节点协同的新计算架构,以支持Agentic AI时代爆发式增长的计算需求。基于灵衢的计算系统具备四大特征:
一、协议归一,内存语义。将十余种互联协议统一为灵衢协议,互联带宽从百GB级提升至TB级,RTT通信时延从7微秒压缩至2微秒,支持超节点内全局内存统一编址。
二、多样算力,异构协同。CPU、NPU、内存、SSD等通过灵衢直接互联,实现去中心化平等访问,CPU和NPU资源可灵活配比。通过分层分级Transformer硬加速,解耦Attention与FFN,实现AF分离部署。
三、分级存储,全局池化。以混合介质资源池化解决激活值缓存问题,将DDR作为NPU“第二内存”,降低搜推广业务时延,千亿级、数千维向量检索性能翻番;降低10T大模型训练对单卡HBM的容量需求,助力提升集群MFU。
四、光电互联,灵活组网。构建全局超高带宽、超低时延“数据高速公路”,实现大小算力灵活扩展。
会上,华为发布分层分级的灵衢互联设备,覆盖柜内、跨柜与集群三级互联,支持从单柜到百万卡集群的弹性扩展。其中,柜内灵衢互联刀片实现零电缆、零电路损耗,一个4096超节点可节省196公里铜缆;跨柜灵衢互联设备支持176个端口,每端口达 1.6T,单机 280T 全光互联,是业界互联带宽最大、端口数最多的高速总线协议互联设备,RTT时延低至2微秒;UBG灵衢网络交换机具备高达1024的超大Radix扇出能力,可支撑百万卡超节点集群,满足模型参数向几十万亿演进的需求。
同时,华为发布基于灵衢的Agentic AI超节点集群,由鲲鹏950、昇腾960超节点、OceanStor M900记忆存储及星河UBG交换机组成,实现多样算力协同与分级资源池化。
灵衢互联技术不仅用于超节点,也适用于一体机。华为基于灵衢架构打造从1卡到8卡的系列化一体机及鲲鹏昇腾模组。其中,Atlas 650E风冷服务器通过双机灵衢直连,实现16个NPU免交换互联,两台机器像一台运行,支持平滑扩容,形成小型超节点,让中小企业也能本地运行万亿参数大模型。
生态方面,昇腾与DeepSeek Harness、OpenCode、openJiuwen等开源框架协同,打造智能管理、推理加速、安全框架等Agent插件化组件并全量开源;已联合50多家客户、伙伴及高校打造26个行业算子库,并与90多家主流开源社区合作,助力伙伴快速完成行业Agent开发与IT系统对接。
AI浪潮下,算力是各行业智能化变革的核心基石。杨超斌表示:“华为将坚持系统级创新,构筑系列化算力底座,开源开放,联合客户、伙伴和开发者共建生态,为世界提供新选择。” 








































