灵晟超算破局:纯CPU架构首抗GPU集群,国产AI算力迎新范式

科技区角 2026-08-07 20:31

【科技纵览】当“跑大模型必用GPU”成为行业铁律时,国产超算“灵晟”以一场静默的技术突围,改写了这一认知。据快科技8月7日消息,这款全球排名第一的国产超算,成功在纯CPU架构下完成了MoE模型的分布式推理部署。仅凭16个计算节点,它便流畅运行起DeepSeek-V3/R1-671B满血模型;在并发数batch_size达到2048的高压场景下,其输出吞吐量竟与80张主流GPU集群持平。这不仅是数据的胜利,更是架构路线的一次正面抗衡。

灵晟的独特性,源于其对传统堆砌GPU方案的摒弃。其自研LX2 CPU内部直接嵌入了矩阵加速单元,支持多精度计算,使得单颗芯片能同时兼顾科学计算与AI推理。这种片上融合设计,彻底消除了CPU与加速卡间数据搬移的冗余开销。然而,算力并非唯一瓶颈,内存带宽往往才是制约大模型推理的关键。为此,LX2集成了首颗国产高带宽内存(HBM),总带宽飙升至4TB/s,较传统CPU提升十倍。配合自研“灵启”高速网络,微秒级时延与十万节点组网能力,一举扫清了计算、带宽及通信三大障碍。

实测数据印证了这一架构的高效:经优化后,MoE推理时延从1440微秒骤降至980微秒。团队更引入DeepSeek多token预测加速技术,进一步推高了输出速率。这意味着,灵晟超算已不再局限于传统科学计算领域,正式切入国产AI大模型的生产服务体系。回顾今年6月23日,灵晟在德国汉堡ISC2026大会上登顶全球TOP500榜单,时隔九年让中国超算重回世界第一。如今,从排名榜首到实战落地,这条纯CPU技术路径的成熟,或许预示着具身智能时代算力供给的新可能——毕竟,当底层硬件不再受制于单一加速卡生态,自主可控的算力底座才真正拥有了韧性。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI GPU
more
联想AI双轨并进:从世界杯赛场到个人终端的智能化跃迁
xAI发布Grok Imagine Image 2.0,剑指专业级图像编辑市场
虚拟人“方桃子”带货引争议,AI广告合规边界亟待厘清
王兴兴回应DeepSeek投资宇树,AI艺人带货美瞳广告下架,东航允许提前14天免费退改签,传雪佛兰退出中国市场,这就是今天的其他大新闻!
谷歌AI重组:创始人布林亲自盯Gemini,哈萨比斯交权
磷化铟缺口超内存!AI光互连的材料危机正在升级
OpenAI紧急叫停Astra模型部分研发,因触及“关键网络安全阈值”
Gemini凉了!创始人布林杀回AI一线,谷歌人心惶惶
价值 350 万的「提示词」开源了,揭秘全球首部全 AI 生成的电影长片
被质疑AI合成,享界G9泥坑测试多机位实拍素材流出
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号