以灵衢互联为核心 打造集群与超节点协同的新计算架构
[中国,灵衢上海,互联2026年9月17日] 在华为全联接大会2026期间,为核华为常务董事、心打协同ICT BG CEO杨超斌发表主题演讲,造集围绕计算架构创新,群超系统阐释了灵衢互联架构,节点计算架构并宣布推出基于灵衢互联架构的灵衢系列化算力底座,持续提升生态能力,互联使能客户、为核伙伴与开发者应用创新。心打协同
华为常务董事、造集ICT BG CEO杨超斌发表主题演讲
在传统计算架构下,群超集群规模扩大时,节点计算架构资源利用率反而下降,灵衢十万卡集群的实际模型算力利用率仅约20%,大量算力处于等待通信完成的状态。10T参数大模型的训练需要海量中间数据,单张显卡的内存容量已难以承载。同时,Agent与模型每小时交互可达数百次,需要CPU与NPU算力灵活配置与协同,产生的KV Cache也远超内存容量,必须依靠跨系统、跨层级存储。集群内不同部件之间的互联与通信能力,已成为决定计算系统性能的关键。
为此,华为以灵衢互联为核心,打造集群与超节点协同的新计算架构,以支持Agentic AI时代爆发式增长的计算需求。基于灵衢的计算系统具备四大特征:
一、协议归一,内存语义。将十余种互联协议统一为灵衢协议,互联带宽从百GB级提升至TB级,RTT通信时延从7微秒压缩至2微秒,支持超节点内全局内存统一编址。
二、多样算力,异构协同。CPU、NPU、内存、SSD等通过灵衢直接互联,实现去中心化平等访问,CPU和NPU资源可灵活配比。通过分层分级Transformer硬加速,解耦Attention与FFN,实现AF分离部署。
三、分级存储,全局池化。以混合介质资源池化解决激活值缓存问题,将DDR作为NPU“第二内存”,降低搜推广业务时延,千亿级、数千维向量检索性能翻番;降低10T大模型训练对单卡HBM的容量需求,助力提升集群MFU。
四、光电互联,灵活组网。构建全局超高带宽、超低时延“数据高速公路”,实现大小算力灵活扩展。
会上,华为发布分层分级的灵衢互联设备,覆盖柜内、跨柜与集群三级互联,支持从单柜到百万卡集群的弹性扩展。其中,柜内灵衢互联刀片实现零电缆、零电路损耗,一个4096超节点可节省196公里铜缆;跨柜灵衢互联设备支持176个端口,每端口达 1.6T,单机 280T 全光互联,是业界互联带宽最大、端口数最多的高速总线协议互联设备,RTT时延低至2微秒;UBG灵衢网络交换机具备高达1024的超大Radix扇出能力,可支撑百万卡超节点集群,满足模型参数向几十万亿演进的需求。
同时,华为发布基于灵衢的Agentic AI超节点集群,由鲲鹏950、昇腾960超节点、OceanStor M900记忆存储及星河UBG交换机组成,实现多样算力协同与分级资源池化。
灵衢互联技术不仅用于超节点,也适用于一体机。华为基于灵衢架构打造从1卡到8卡的系列化一体机及鲲鹏昇腾模组。其中,Atlas 650E风冷服务器通过双机灵衢直连,实现16个NPU免交换互联,两台机器像一台运行,支持平滑扩容,形成小型超节点,让中小企业也能本地运行万亿参数大模型。
生态方面,昇腾与DeepSeek Harness、OpenCode、openJiuwen等开源框架协同,打造智能管理、推理加速、安全框架等Agent插件化组件并全量开源;已联合50多家客户、伙伴及高校打造26个行业算子库,并与90多家主流开源社区合作,助力伙伴快速完成行业Agent开发与IT系统对接。
AI浪潮下,算力是各行业智能化变革的核心基石。杨超斌表示:“华为将坚持系统级创新,构筑系列化算力底座,开源开放,联合客户、伙伴和开发者共建生态,为世界提供新选择。”
2026年9月17-19日,华为全联接大会2026在上海世博展览馆及世博中心举办。本届大会以“智启新未来”为主题,通过“战略全景-产业技术-生态发展”的三维视角,阐释华为全面智能化战略的最新举措,并发布创新的产品与解决方案、丰富的行业智能化应用样板点、好用易用的开发者工具与平台等。欲了解更多详情,请参阅华为全联接大会官网
相关文章
北京时间2026年9月24日消息。日本爱知名古屋亚运会,今天晚上迎来女团决赛。中国国乒VS日本队。第一盘,孙颖莎出场,3-1击败早田希娜。随后第二盘登场的是王曼昱,她迎战张本美和。双方经过5局激战,王2026-09-27
2026-09-27
2026-09-27
2026-09-27
9月21日消息,长期以来,大众普遍认为肺结节、肺癌主要是长期吸烟人群的问题,但钟南山团队最新的一项大样本研究刷新了认知:在偶然检出肺结节的人群中,71.34%的患者从不吸烟。该研究已于2026年8月发2026-09-27
2026-09-27
最新评论