2026世界人工智能大会(WAIC)7月17日于上海正式启幕,华为Atlas 950 SuperPoD超节点AI算力集群真机完成国内首次公开落地展出,这也是当前商用领域规模最大的AI超节点产品,标志国产算力正式从单芯片单点突破,迈入芯片-服务器-高速互联-集群调度-智算机房全链路软硬件自主可控的系统级算力时代,为万亿参数大模型训练、科学计算、政企智算中心筑牢国产化底层基座。

文章导航
一、产品基础定位与核心硬件规格
Atlas 950 SuperPoD是华为昇腾全栈算力体系的旗舰级万卡级超算单元,以单机柜64张昇腾950DT NPU加速卡作为基础模块化单元,整机最大可横向扩展接入8192张自研算力芯片,物理上分散的上百机柜集群通过自研协议封装为单一逻辑超级计算机,彻底解决传统多机集群通信损耗高、算力利用率低的行业痛点。
核心关键参数一览
| 指标项 | Atlas 950 SuperPoD 顶配集群 | 行业对标NVL144对比 |
|---|---|---|
| 最大可互联算力卡数量 | 8192张昇腾950DT | 仅144张,规模仅为其1/56.8 |
| FP8总算力 | 8 EFLOPS | 算力约为其1/6.7 |
| FP4总算力 | 16 EFLOPS | 低精度推理优势显著放大 |
| 全局统一内存总容量 | 1152TB | 仅为其1/15 |
| 系统总互联带宽 | 16.3PB/s | 带宽差距超一个数量级 |
| 单卡标配内存 | 144GB国产HiZQ 2.0 HBM | 自主显存无海外供应链依赖 |
| 单卡内存带宽 | 4TB/s | 适配超大上下文模型吞吐需求 |
昇腾950DT为全系自研AI训练专用芯片,双Die融合架构,原生兼容FP8、MXFP4、HiF8等AI主流计算精度,芯片级、板卡级、集群级三层软硬件均无境外核心技术卡脖子环节。
二、自研灵衢2.0全光互联,破解集群算力损耗难题
传统AI集群跨节点数据传输会占用30%以上算力资源用于数据等待,算力实际利用率长期仅30%左右。 华为为Atlas 950搭载灵衢UnifiedBus 2.0对等互联协议,实现NPU、CPU、内存无CPU中转直接互通,搭配统一内存编址架构:
- 机柜内、机柜间全光无损高速组网,集群收敛比趋近于1:1无阻塞;
- 整体算力综合利用率提升至70%以上,同等卡量下训练速度提升近一倍;
- 支持万卡集群线性扩容,新增机柜可一键并入超节点体系,无需重构集群调度架构。
整机配套华为数字能源全液冷AIDC方案,智算中心PUE可降至1.15以下,在当前全球多地数据中心水电能耗管控收紧背景下,大幅降低机房能耗与运维成本,适配国内各地新建智算中心能耗审批规范。

三、全链路国产化闭环,实现算力底座100%自主可控
整套Atlas 950超节点构建从底层元器件到上层运维平台完整国产技术栈,彻底脱离海外算力生态绑定:
- 计算层:昇腾950系列NPU、鲲鹏通用服务器CPU均为华为自研设计,核心IP无外部授权;
- 互联层:灵衢协议、高速交换机、光模块由华为及国内生态伙伴联合供货;
- 存储内存:HiBL、HiZQ系列国产HBM高速内存,替代海外HBM显存方案;
- 系统软件:昇腾CANN算子库、MindSpore大模型框架、集群调度CloudMatrix均为原生自研;
- 部署运维:配套华为云智算管理平台,支持私有化内网离线部署,涉密政务、央企、金融机构可实现数据与算力完全不出域。
同步展出轻量化版本Atlas 850E风冷超节点,无需机房改造液冷环境,传统机房即可部署超节点架构,降低中小企业与地方科研院所接入万卡级集群的门槛。
四、核心落地适配场景
- 通用大模型基座训练 可一次性承载万亿参数超大基座模型完整预训练、微调任务,适配混元、文心、通义等国产大模型长期迭代需求,支撑256K/1024K超长上下文模型高效训练。
- 科研与前沿计算 用于生物医药分子模拟、地质地层推演、可控核聚变仿真、气象气候预测等超算场景,替代传统进口超算集群。
- 政企专属智算中心 面向省级政务算力枢纽、央企行业AI平台、国有云厂商提供本地化超节点整机交付,满足数据安全与信创合规硬性要求。
- 具身智能与机器人集群训练 批量完成人形机器人环境仿真、多智能体协同策略训练,适配宇树等国产机器人厂商大规模算法迭代需求。
五、产业生态与长期战略意义
- 补齐国内高端算力集群短板 此前万卡级商用超算集群长期被海外方案垄断,Atlas 950落地标志我国具备自主设计、量产、交付顶级AI超节点的全链条能力,筑牢AI产业供应链安全底线。
- 推动昇腾生态规模化放量 截至2026年上半年,全球部署昇腾算力卡超52万张,Atlas超节点作为顶层硬件产品,将带动上下游服务器、光通信、内存、PCB国内供应链订单扩容。
- 确立架构创新新路线 华为提出“韬定律”:不再单一依赖芯片制程升级算力,依靠超节点架构+高速互联实现集群性能跃迁,为成熟工艺芯片突破算力物理天花板提供全新技术范式。

六、WAIC同期配套方案
本次大会华为除真机硬件展示外,同步发布:
- 面向开发者的超节点按需租赁算力服务;
- 行业垂直大模型一键迁移上昇腾集群工具链;
- 多智能体Agent集群调度配套运行框架,打通底层算力与上层AI应用的全链路落地。