【区角快讯】当人工智能从单纯的模型训练迈向复杂的Agent推理与长序列处理,底层基础设施的瓶颈便日益凸显。9月17日,在上海拉开帷幕的华为全联接大会2026上,华为给出了新的解题思路——基于灵衢技术推出的AI记忆存储新品OceanStor M900。这不仅是硬件的迭代,更是对多层次KV Cache架构的一次深度重构。
针对Agent推理系统对数据吞吐的苛刻要求,华为构建了支持“一跳直连”的L3.5层PB级KV缓存集群。值得注意的是,M900并未止步于连接速度的提升,其采用的混合介质搭配优化后的Retention算法,将SSD读写寿命硬生生提升了16倍。这种从底层保障KV命中率与长期稳定性的设计,恰恰击中了当前大模型应用落地的痛点。
与此同时,全新的Agentic超节点集群也正式亮相,旨在加速10万亿参数级别的大模型训练与推理进程。该集群的核心在于灵衢UnifiedBus统一互联技术,它将原本繁杂的多种互联协议归一化,大幅削减了协议转换带来的开销。在这种架构下,昇腾超节点、鲲鹏超节点以及KV缓存集群实现了真正的平等互联,各类KV缓存均可实现一跳直达,构建起一个高带宽、大容量且层次分明的存储生态。
在网络拓扑层面,通过二层CLOS四平面组网,最大集群规模可拓展至51.2万卡;若结合多轨道拓扑技术,这一数字更可攀升至100万卡昇腾超节点集群。这种规模的扩展能力,意味着华为正在为未来更具野心的AI算力需求铺设一条宽阔的高速公路。从某种角度看,这不仅是算力的堆叠,更是数据流动效率的革命性突破。
华为发布OceanStor M900,灵衢架构重塑AI存储底座
科技区角
2026-09-17 15:01
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。