【科技纵览】当“跑大模型必用GPU”成为行业铁律时,国产超算“灵晟”以一场静默的技术突围,改写了这一认知。据快科技8月7日消息,这款全球排名第一的国产超算,成功在纯CPU架构下完成了MoE模型的分布式推理部署。仅凭16个计算节点,它便流畅运行起DeepSeek-V3/R1-671B满血模型;在并发数batch_size达到2048的高压场景下,其输出吞吐量竟与80张主流GPU集群持平。这不仅是数据的胜利,更是架构路线的一次正面抗衡。
灵晟的独特性,源于其对传统堆砌GPU方案的摒弃。其自研LX2 CPU内部直接嵌入了矩阵加速单元,支持多精度计算,使得单颗芯片能同时兼顾科学计算与AI推理。这种片上融合设计,彻底消除了CPU与加速卡间数据搬移的冗余开销。然而,算力并非唯一瓶颈,内存带宽往往才是制约大模型推理的关键。为此,LX2集成了首颗国产高带宽内存(HBM),总带宽飙升至4TB/s,较传统CPU提升十倍。配合自研“灵启”高速网络,微秒级时延与十万节点组网能力,一举扫清了计算、带宽及通信三大障碍。
实测数据印证了这一架构的高效:经优化后,MoE推理时延从1440微秒骤降至980微秒。团队更引入DeepSeek多token预测加速技术,进一步推高了输出速率。这意味着,灵晟超算已不再局限于传统科学计算领域,正式切入国产AI大模型的生产服务体系。回顾今年6月23日,灵晟在德国汉堡ISC2026大会上登顶全球TOP500榜单,时隔九年让中国超算重回世界第一。如今,从排名榜首到实战落地,这条纯CPU技术路径的成熟,或许预示着具身智能时代算力供给的新可能——毕竟,当底层硬件不再受制于单一加速卡生态,自主可控的算力底座才真正拥有了韧性。
灵晟超算破局:纯CPU架构首抗GPU集群,国产AI算力迎新范式
科技区角
2026-08-07 20:31
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。