华为昇腾960超节点发布:业界首个采用NPO的超节点 支持十万亿大模型训练和推理

华为昇腾960超节点发布:业界首个采用NPO的超节点 支持十万亿大模型训练和推理

  9月17日,华为全联接大会2026在上海启幕 ,华为副董事长、轮值董事长汪涛在主题演讲环节发布全球首个采用NPO技术的超节点——昇腾960超节点,加速十万亿规模的大模型训练和推理 。

华为昇腾960超节点发布:业界首个采用NPO的超节点 支持十万亿大模型训练和推理-第1张图片

  据介绍,昇腾960超节点基于“灵衢+Hi-ONE”打造。作为全球首个采用NPO光引擎的超节点 ,昇腾960超节点采用正交架构和全液冷设计,基于灵衢实现内存统一编址,可扩展至4096卡规模 ,实现8EFLOPS FP〖捌〗 、 16EFLOPS FP4。昇腾960超节点用5500个Hi-ONE,替代原本需要的4万8千颗800G光模块,功耗降低超550千瓦 ,系统无故障运行时间提升一倍 ,系统可用度达到99.8%,加速前沿模型的训练与推理创新 。

  汪涛表示,华为坚持系统级创新 ,把多年来积累的光技术,用于超节点系统内,推出全球首个NPO光引擎Hi-ONE。据了解 ,这是业界首个量产的NPO产品,是行业近来 最大传输能力的NPO产品,总容量达到7.2T ,也是唯一实现内置光源的NPO产品。

  随着大模型迈向十万亿级规模,超节点是超大规模AI基础设施建设的必然选取  。华为超节点设计理念是以一套协议平等连接集群内所有组件、支持跨物理服务器的内存访问、并采用近铜远光的互连。

  这次华为将超节点架构引入通算系统,全新升级鲲鹏超节点 ,基于灵衢全光组网,最大支持4096节点,形成256TB统一内存池 ,可实现Agent更高密的沙箱 、更快的沙箱启动速度和更好的Agent向量检索性能。同时 ,发布了基于灵衢UnifiedBus总线、支持“一跳直连 ”的L3.5层PB级KV缓存解决方案 OceanStor M900 集群 。

  据介绍,多个昇腾960超节点,采用灵衢网络或RoCE连接在一起 ,构建更大规模的超节点集群,最大集群规模可达到51.2万卡,再结合多轨道拓扑技术 ,最大可支持100万卡昇腾超节点集群 。

  汪涛也在主题演讲中披露了华为昇腾芯片的最新进展。其中,昇腾960芯片研发进度超预期,性能实现倍增。昇腾960DT在推出时间比原目标提前三个季度 ,将在2027年一季度就会准备就绪 。昇腾960PR将在2027年的三季度可以准备就绪,未来昇腾的芯片将继续坚持一年一代的演进节奏,在2028年和2029年将陆续推出昇腾970和昇腾980芯片 ,依托韬定律的创新方向来实现算力规格继续翻倍。

(文章来源:澎湃新闻)

©版权声明
THE END