能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据

全球半导体观察 2026-08-27 12:36

当地时间8月25日,OpenAI公布了其首款自研AI推理芯片“哈拉佩尼奥”(Jalapeño)的最新第三方基准测试数据。


数据显示,在单位功耗下,该芯片的AI推理性能达到英伟达旗舰算力系统GB200、GB300的1.5至1.9倍,端到端推理延迟时间大幅减少40%至70%(即响应速度提升1.7至3.6倍)。这一突破意味着,在缓解大语言模型(LLM)及AI智能体(AI Agent)应用的高功耗与高延迟痛点上,专用ASIC芯片正展现出显著优势。


能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据图2

图片来源:OpenAI


“哈拉佩尼奥”是OpenAI于2026年6月发布的首款自研AI推理芯片,研发代号源自墨西哥哈拉佩尼奥辣椒。与通用GPU不同,“哈拉佩尼奥”是一款专为大语言模型推理场景优化的定制芯片(ASIC),主要用于支撑ChatGPT等产品的实时推理,旨在降低推理成本、提升推理速度。


从研发细节来看,该芯片由OpenAI负责整体架构设计,并与博通(Broadcom)深度合作完成芯片实现、网络连接及量产整合,由台积电代工,研发至流片(Tape-out)全周期仅耗时9个月。


在硬件配置上,“哈拉佩尼奥”额定功耗为700W,测试中的持续运行功耗控制在550W以内。该芯片通过将芯片、高带宽内存(HBM)、网络与推理软件协同规划,极大地减少了模型推理过程中的跨节点数据搬运,从根本上优化了KV Cache(键值缓存)管理,有效解决了高并发下的延迟瓶颈。


在部署节奏方面,OpenAI硬件负责人介绍,该芯片目前已进入工程样品测试阶段,计划于2026年年底前开展小规模试点部署,规模化商业应用与吉瓦(GW)级数据中心建设预计将在2027年全面铺开。


   


 全球半导体观察 

往期推荐

能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据图3

能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据图4

能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据图5

能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据图6



关于集邦咨询

能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据图7

TrendForce集邦咨询作为全球高科技产业研究机构,致力于洞察AI全链脉络,助力企业战略决策。研究版图聚焦AI产业增长引擎,涵盖:HBM、DRAM、NAND Flash等关键存储产品;GPU、ASIC等AI算力芯片;晶圆代工、芯片设计及封测;以及AI服务器、显示面板、LED、AR/VR等基础设施与终端,延伸至自动驾驶、具身智能、光伏储能、低空经济等“AI+”垂直产业集群,同时提供核心零部件价格预测与数据库。凭借多年深耕,为政企客户与投资者提供行业研究报告、企业战略咨询及品牌整合行销等服务。

能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据图8

让更多人看到


能效超越英伟达GB200/GB300?OpenAI公布自研芯片测试数据图9

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI 测试 芯片 英伟达
more
英伟达半数打工人身家过亿!难怪离职率低
OpenAI掀桌,自研芯片超越英伟达
对华出口LPU?英伟达否认!
英伟达开始谈Scale in
涨幅逾15%?英伟达或调涨AI服务器价格
OpenAI「辣椒」芯片跑分超英伟达/苹果发布全球首款量产2nm芯片,新Mac mini价格大涨/Codex将恢复5小时用量窗口
英伟达变身“隐形银行”:千亿美元担保背后的AI豪赌与风险隐忧
英伟达都摁不住了!内存疯涨,AI服务器被曝涨价超15%
不买英伟达?AI巨头集体涌向自研芯片
突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号