7月20日,在2026世界人工智能大会(WAIC 2026)上,百度旗下昆仑芯科技带来了一个备受关注的展品——面向大模型推理的第四代AI芯片M100实物。
值得一提的是,这是M100首次公开亮相。昆仑芯CEO欧阳剑在做客央视新闻直播间时,也亲自展示了这颗芯片。从2025年11月百度世界大会上的首次披露,到如今的实物亮相,M100的登场节奏紧凑而清晰。

(央视新闻直播截图)
定位清晰:全国产供应链,对标英伟达H20
M100的产品定位非常明确:基于全国产供应链打造,主要对标英伟达H20,主打高性价比推理应用。
作为参照,英伟达H20基于Hopper架构,配备96GB HBM3显存,显存带宽4.0TB/s,FP8算力296 TFLOPS,FP16算力148 TFLOPS,TDP功耗400W。这款芯片是英伟达面向中国市场的特供产品,算力参数相比H100大幅削减,但凭借96GB大显存和4TB/s带宽,在推理场景中仍具备很强的竞争力。而M100的目标,正是在H20最擅长的推理场景中,以更低的成本和更高的能效比实现替代。
在核心配置上,M100的HBM容量相比H20略低一些,但整体能效比与单位算力成本具备显著优势,适用于对成本敏感且对推理吞吐要求较高的大规模部署场景。在国产替代的大背景下,一颗“全国产化”的推理芯片,其意义不止于参数对标。
不止M100:昆仑芯的产品线正全面铺开
M100并非昆仑芯的第一款产品,在本届WAIC上,与其一同展出的还有已经大规模出货的P800加速卡。
据悉,P800是昆仑芯2024年推出的第三代AI加速器,基于自研XPU架构,配备96GB HBM,FP16算力达345 TFLOPS,支持FP8/FP16/FP32多种精度计算。
另外,P800落地进展也相当快:2025年4月,百度成功点亮基于P800的3.2万卡超级集群;2026年4月,基于P800的天池256卡超节点首次点亮,吞吐性能较上一代提升25%,推理效率提升50%。目前,P800已适配文心、DeepSeek、GLM、MiniMax等主流模型,并在招商银行、中国移动、国家电网等行业落地。
在产品规划上,昆仑芯的路线图清晰可见:除了M系列推理芯片,昆仑芯同时在研发新一代P系列高性能AI芯片,直接对标华为昇腾950。加上计划2027年初上市的M300,昆仑芯正在形成“训练+推理”双线推进的产品矩阵。
市场格局:国产AI加速卡占比已超四成
M100的亮相,恰逢国产AI芯片市场份额的关键转折点。
根据IDC数据显示,2025年中国AI加速卡总出货约400万张,而国产厂商合计出货约165万张,占比41%。其中,华为昇腾以81.2万张稳居第一;阿里平头哥以26.5万张位居第二;昆仑芯与寒武纪各出货约11.6万张,并列国产第三。要知道,在几年前,英伟达在中国AI芯片市场的份额还高达95%。
从“有没有”到“好不好用”,国产AI芯片正在进入新的竞争阶段。未来,随着M100等新一代产品陆续落地,推理侧的国产替代节奏有望进一步加快。
最后,大家看好昆仑芯M100的市场前景吗?欢迎在评论区,聊聊你的看法。
END

往期精选:

请点下【♡】给小编加鸡腿
