国产算力破局:移动云发布首个GPU+类脑异构推理系统

科技区角 2026-09-14 10:01

【区角快讯】在2026中国算力大会的聚光灯下,一项旨在打破算力垄断的技术成果正式亮相。由移动云牵头,联合中国电子科技南湖研究院、北京灵汐科技、上海天数智芯以及清华、北大两所顶尖高校,共同推出了国内首款基于国产GPU与类脑芯片深度融合的大模型异构混合推理系统。这一架构直接对标英伟达Vera Rubin搭配Groq的高端方案,标志着国产算力在底层架构创新上迈出了关键一步。

该系统并未简单堆砌硬件,而是从系统架构层面进行了大胆重构。团队创新性地将Transformer模型拆解为PD(预填充)和AF(自回归)两个阶段,实施分离推理。其中,计算密集型的Attention注意力机制交由国产GPU处理,充分发挥其通用计算的长板;而对延时极度敏感的FFN前馈网络模块,则部署于类脑芯片之上,利用其存算一体及片上大容量SRAM的优势实现极速响应。这种“各司其职”的策略,彻底突破了传统单GPU推理的性能天花板。

为了支撑这一复杂架构,项目组自研了模型编译器、高速互联协议及统一推理引擎,实现了两类异构算力的无缝协同与结果聚合。实测数据显示,在运行DeepSeek V4 Flash模型时,该系统的推理输出速度与能效比同类国产GPU集群均提升超过一倍,同时业务运营成本下降逾40%,真正实现了高性能下的自主可控。

中国移动云公司类脑与光实验室技术总监杜宇健形象地比喻道,引入类脑算力如同给现有GPU资源加装了“涡轮增压”,使得国产芯片无需依赖先进制程,即可实现推理性能的翻倍跃升。目前,该成果已能广泛适配Token工厂、AI代码生成、多智能体协同及智能制造等高实时性场景,并为金融、安防等安全敏感行业提供全栈国产化底座。未来,团队计划逐步开放核心异构推理框架,赋能更多国产芯片厂商与算力运营商,构建更开放的生态体系。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
GPU
more
Arm发布CSS for Mobile 2:GPU唱主角
A20 Pro 裸片分析:GPU核心数量创纪录!
苹果首款 2nm 手机芯来了!A20 Pro 登场,CPU 暴涨 20%、GPU 飙升 40%!顺便发布C2基带,基本告别高通!
当AI不再只有GPU:中星微技术押注XPU,寻找端侧智能的新解法
燧原科技IPO:腾讯“输血”下的国产GPU最后一块拼图
下周三只新股申购,“国产GPU四小龙”终聚首资本市场
Meta最新成果:FleetSieve让LLM集群配置效率暴涨,省21.5%GPU算力
GPU,跌落神坛
Arm重构移动计算:CPU编排智能体,GPU踏入“AI像素重建时代”
开盘仅上涨195%!国产GPU四小龙最后一家成功上市!
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号