【区角快讯】当大模型参数量级迈入“万亿俱乐部”,底层算力的适配能力便成了检验技术成色的试金石。7月28日,阿里云正式对外披露,其自研的真武M890超节点实例已在Day0阶段成功适配Kimi K3模型。这一里程碑式的进展,标志着国内首个能够完整运行近3万亿参数模型的超节点集群正式落地。
要驾驭Kimi K3这样拥有2.8万亿参数的庞然大物,绝非易事。传统AI集群往往受限于通信带宽,难以满足高吞吐、低延迟及高并发的严苛需求。为此,必须将海量参数分散至数十甚至上百张高速互联的GPU卡上协同工作。真武超节点的设计初衷,正是为了击穿这一性能瓶颈。其核心组件真武M890芯片采用自研并行计算架构,单卡内置144GB显存;而基于该芯片打造的磐久AL128超节点服务器,通过自研互联芯片实现了单机柜128卡的紧密耦合,点对点时延被压缩至150纳秒以内。
值得注意的是,借助ICN Switch 1.0互联芯片,64张真武M890可实现高达800GB/s的高速互联,总显存规模达到惊人的9TB。这种配置使得单个实例便能支撑大规模万亿级参数MoE模型的部署。为了进一步挖掘硬件潜力,阿里云、平头哥与Kimi团队在软件栈和算子层面进行了深度联合调优。针对Kimi K3的核心算子,真武M890进行了专项优化,从而大幅提升了推理过程中的算力与带宽利用率。
实测数据印证了这一优化的成效:适配后,模型的首Token时延降低了约35%,单卡解码吞吐量更是提升了1.8倍,足以稳定支持百万级长上下文场景。阿里云方面表示,千问AI平台及阿里云百炼也将同步上线Kimi K3的模型API服务,以实现更深层次的生态协同。随着国内外主流模型纷纷突破2万亿参数大关,真武超节点的成功跑通,不仅验证了Kimi K3的高效运行,更向业界证明,国产算力已具备支撑超大参数模型规模化应用的实力。
阿里云真武M890首跑通Kimi K3,国产算力突破万亿参数瓶颈
科技区角
2026-07-28 10:00
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。