华为昇腾950超节点亮相:千卡合一,重塑AI算力边界

科技区角 2026-09-21 16:01

【区角快讯】在2026世界人工智能大会的聚光灯下,华为揭开了业界最大规模超节点产品的神秘面纱——昇腾950超节点真机首次公开亮相。这并非简单的硬件堆叠,而是一次对传统AI集群架构的颠覆性重构。其核心愿景,是将上千张NPU封装进一台逻辑统一的“超级计算机”,直击大模型训练中多卡通信延迟这一长期痛点,专为万亿级参数训练及高并发中心推理场景打造。

从微观芯片到宏观集群,昇腾950DT NPU构成了这套系统的计算心脏。单颗芯片针对大模型训练与解码推理进行了深度优化,搭载HiZQ 2.0 HBM高带宽内存,单卡容量高达144GB,带宽飙升至4TB/s。它不仅支持FP16、BF16等常规精度,更兼容FP8、MXFP4等多精度AI计算,完美适配预训练、长上下文推理以及MoE混合专家模型等复杂场景。

架构设计上,模块化思维贯穿始终。标准配置包含16台计算柜与4台灵衢互联柜,最大可容纳1024张昇腾950DT NPU,并配套256颗鲲鹏950 CPU。这种组合能爆发出惊人的算力:最高提供1 EFLOPS FP8算力或2 EFLOPS FP4算力。关键在于,它打破了服务器间的物理壁垒,让上千颗NPU如同单一设备般协同工作,显著提升了算力利用率,解决了传统集群中因数据交换开销巨大导致的效率衰减问题。

连接这些算力单元的,是华为自研的灵衢2.0全光互联协议。通过跨机柜全光Mesh直连,整套集群总互联带宽达到1.72PB/s,跨柜往返时延被压缩至惊人的3微秒。更值得注意的是,它支持256TB全局内存统一编址,上千张NPU共享同一内存空间,无需在独立服务器间反复搬运海量模型数据,极大降低了通信损耗。

稳定性方面,全液冷散热方案支撑单柜最高100kW大功率供电,确保高密度算力持续稳定运行。可靠性设计同样严苛,2+2光路保护机制配合灵衢链路的闪断自恢复能力,即便部分链路故障,业务也不会中断,满足7*24小时不间断训练需求。软件生态上,依托昇腾CANN全栈平台及配套工具链,支持模型迁移与分布式训练优化。该产品计划于2026年四季度正式上市,未来还可通过多套超节点互联,进一步扩展至更大规模的算力集群,为Agent智能体等高算力需求场景提供坚实底座。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI 华为
more
查尔斯三世召集AI巨头闭门会,警示生存级风险呼吁建立管控机制
安克创新与阿里云围绕全栈AI达成战略合作
AI红娘,能牵到正缘吗?
AI制药新突破:英矽智能药物让患者生物年龄“倒流”近六年
华为昇腾950超节点亮相:千卡合一,重塑AI算力边界
奥特曼落榜!OpenAI总裁255亿杀进全美富豪前50
小米AI测试产品“龙虾”正式停运,澎湃OS 4用户将自动退出封测
联想平板战略转向“AI+”:从工具到智能伙伴的底层重构
百亿终端的AI破局,从轻智能开始
剪映,杀入 AI 互动影游
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号