【区角快讯】在2026世界人工智能大会的聚光灯下,华为揭开了业界最大规模超节点产品的神秘面纱——昇腾950超节点真机首次公开亮相。这并非简单的硬件堆叠,而是一次对传统AI集群架构的颠覆性重构。其核心愿景,是将上千张NPU封装进一台逻辑统一的“超级计算机”,直击大模型训练中多卡通信延迟这一长期痛点,专为万亿级参数训练及高并发中心推理场景打造。
从微观芯片到宏观集群,昇腾950DT NPU构成了这套系统的计算心脏。单颗芯片针对大模型训练与解码推理进行了深度优化,搭载HiZQ 2.0 HBM高带宽内存,单卡容量高达144GB,带宽飙升至4TB/s。它不仅支持FP16、BF16等常规精度,更兼容FP8、MXFP4等多精度AI计算,完美适配预训练、长上下文推理以及MoE混合专家模型等复杂场景。
架构设计上,模块化思维贯穿始终。标准配置包含16台计算柜与4台灵衢互联柜,最大可容纳1024张昇腾950DT NPU,并配套256颗鲲鹏950 CPU。这种组合能爆发出惊人的算力:最高提供1 EFLOPS FP8算力或2 EFLOPS FP4算力。关键在于,它打破了服务器间的物理壁垒,让上千颗NPU如同单一设备般协同工作,显著提升了算力利用率,解决了传统集群中因数据交换开销巨大导致的效率衰减问题。
连接这些算力单元的,是华为自研的灵衢2.0全光互联协议。通过跨机柜全光Mesh直连,整套集群总互联带宽达到1.72PB/s,跨柜往返时延被压缩至惊人的3微秒。更值得注意的是,它支持256TB全局内存统一编址,上千张NPU共享同一内存空间,无需在独立服务器间反复搬运海量模型数据,极大降低了通信损耗。
稳定性方面,全液冷散热方案支撑单柜最高100kW大功率供电,确保高密度算力持续稳定运行。可靠性设计同样严苛,2+2光路保护机制配合灵衢链路的闪断自恢复能力,即便部分链路故障,业务也不会中断,满足7*24小时不间断训练需求。软件生态上,依托昇腾CANN全栈平台及配套工具链,支持模型迁移与分布式训练优化。该产品计划于2026年四季度正式上市,未来还可通过多套超节点互联,进一步扩展至更大规模的算力集群,为Agent智能体等高算力需求场景提供坚实底座。
华为昇腾950超节点亮相:千卡合一,重塑AI算力边界
科技区角
2026-09-21 16:01
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。