希奥端计算:“推理特化”的服务器CPU如何卡位Agent AI时代?

电子发烧友网Elecfans 2026-08-28 07:00
电子发烧友网报道(文/梁浩斌)在近日ICDIA 2026的媒体群访现场,希奥端计算首次公开露面披露了其产品与战略细节。这家成立四年、刚完成数亿元A轮融资的服务器CPU初创公司,给出了一条与英伟达、ARM等巨头错位竞争的国产芯片路径:用ARM生态尽快商业落地、用RISC-V布局未来;首款24核产品BlueDot V1已流片,计划2026年底小批量试商用。

希奥端计算:“推理特化”的服务器CPU如何卡位Agent AI时代?图1
图:希奥端计算生态合作总监肖军

ARM换商业落地,RISC-V换未来

对于公司选择ARM与RISC-V两条路线的原因希奥端计算生态合作总监肖军在接受采访时表示:ARM生态成熟、性能好,选择ARM是为了尽快商业落地;RISC-V开放灵活、潜力大,所以要提前布局。

在这背后,公司实际上有三个产品在并行第一代ARM产品BlueDot V1已流片,第二代ARM产品在研发,第一代RISC-V产品也在研发。人员配置上目前ARM线的投入更大,但随着公司规模扩张,RISC-V上的投入也在逐渐加大,内核均为授权IP。

当被问及相比国内其他ARM CPU厂商的优势时,肖军把答案落在团队上。他强调CPU行业门槛很高,大CPU芯片的研发中,每一个环节都需要有八到十年甚至十几年经验的专家独当一面,这样的团队在国内很难找,而希奥端核心团队大多来自头部大厂,人员的配备是我们很重要的一个优势

Agent AI时代,CPU时延占比高达50%~90%

肖军指出,Agent AI引入了感知、认知、决策、行动的自主循环,循环中CPU主要负责环境感知、任务编排、工具调用,这使得CPU时延占到整个处理时延的50%~90%,远高于传统云计算时代CPU的时延占比。因此在他看来,Agent AI时代对CPU核性能、内存带宽和IO带宽的要求,比云时代更高。

这一判断直接定义了BlueDot V1的产品形态。在AI推理场景中, 由于AI模型参数量大,Agent的上下文长度较长时GPU的显存容量很难同时容下模型权重和上下文的KV Cache,所以推理过程中KVCache需要在GPU的显存和CPU的内存之间来回传输,这个时候内存带宽和IO带宽就显得非常重要。邓俊勇与肖军都承认,CPU在推理环节主要是做任务编排,但带宽是绕不开的约束,而BlueDot V1恰好在这两项规格上做了文章。

BlueDot V1拥有24核,采用ARM Neoverse V3内核,亚马逊Graviton5、微软Cobalt200均采用同款内核,ARM今年发布的AGI CPU产品也基于该核。内存方面支持DDR5,速率达8000MT/S,高于目前市面主流产品;互联方面支持PCIe6.0,而主流产品仍以PCIe5.0为主。围绕这颗芯片,公司定义了四大目标场景:通用服务器(中小企业通用计算)、边缘AI推理服务器、存储服务器和工作站。

值得注意的是,BlueDot V1的24核规模与英伟达Vera(88核级)、ARM高端产品(上百核)、x86旗舰(200核级)相比明显更小,但希奥端明确不打算在核数上与们正面对撞。肖军的逻辑是:对方走高端路线,面向训练等场景,一个CPU可以配4到8训练设备,价格不言而喻;希奥端聚焦推理场景,一个CPU配2到4个推理设备,从场景到价格都错开,不要跟它直面去竞争。商业模式上则更灵活可以只卖芯片,也可以依托完整的上下游生态做成整机,让客户打上自己的LOGO去卖。

生态要先行

CPU是典型的生态型产业,肖军在采访中反复强调必须生态先行”,不能等产品出来之后再补生态,否则就是产品在等生态,一定来不及。所以公司在芯片定义阶段就开始布局生态,在研发过程中同步构建。

具体动作包括迁移调优工具与产品基本同步发布;加入欧拉社区、龙芯社区及国内联盟组织,参与标准制定与白皮书编写;把行业内主流的基础开源软件,包括操作系统、数据库、中间件的测试用例提前梳理准备,产品一出来即可适配;同时已与几家大型基础商业软件厂商沟通,双方合作意愿较强,因为商业软件厂商本身也有做生态的需求。

而生态建设最直观的进展是产品在流片之前,希奥端计算已在EMU(仿真)与FPGA环境中将主要操作系统跑了起来,包括CentOS、Open Euler与Ubuntu等。对于RISC-V生态,肖军的判断是技术栈与ARM不同、不能完全复用,两者是两个圈子但部分伙伴是同一家——例如操作系统厂商同时提供ARM与RISC-V版本,这种跨路线的合作关系可以复用。

针对国内ARM服务器CPU厂商多聚焦信创的行业现状,肖军明确表示现阶段以商业市场为主。信创市场有资质要求,拿到资质需要时间且有一定门槛,而商业市场没有这道门槛, 。与英伟达、ARM等海外厂商的关系则是错位竞争:对方做海外高端市场,希奥端计算聚焦国内市场;对方芯片规格高、走高端路线,公司将以更灵活的商业玩法和更聚焦的边缘推理场景切入。(全文完)

希奥端计算:“推理特化”的服务器CPU如何卡位Agent AI时代?图2

声明:本文由电子发烧友原创,转载请注明以上来源。如需入群交流,请添加微信elecfans999,投稿爆料采访需求,请发邮箱wuzipeng@elecfans.com


更多热点文章阅读



点击关注 星标我们



将我们设为星标,不错过每一次更新!

希奥端计算:“推理特化”的服务器CPU如何卡位Agent AI时代?图3喜欢就奖励一个“在看”吧!


关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI 服务器
more
AI落地,这些问题值得当面聊一聊
AI加速向设备端迁移,“研华AMD嵌入式平台解决方案线上研讨会”成功举办
OpenAI Astra 要来了,网安能力到 Critical,高级能力先不开放
有人@你,灿芯半导体邀您解码AI风向标!
AI修车?网友实测大模型诊断引擎,被指“赛博朋克”却低效高危
戴尔财报狂飙背后:AI订单爆满却陷“缺芯”困局
制造业龙头,给工业AI补上了哪一块短板?
WorkBuddy第一次上眼镜,怎么又是乐奇AI眼镜?
突发:OpenAI Astra模型被曝安全风险
国产AI芯片,不够卖了
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号