这款AI芯片比GPU大58倍,速度快15倍

半导体芯闻 2026-07-23 17:49
👆如果您希望可以时常见面,欢迎标星🌟收藏哦~

在加利福尼亚州圣克拉拉市的一个数据中心内。通过安检后,一排排比人还高的黑色服务器机架整齐排列。服务器风扇持续运转,发出震耳欲聋的轰鸣声,足以盖过周围的人声,而液冷管道则循环流动,散发着服务器产生的巨大热量。


这款AI芯片比GPU大58倍,速度快15倍图1

Cerebras首席营销官Julie Choi在美国加利福尼亚州圣克拉拉市的一个数据中心讲解配备Cerebras人工智能芯片的服务器和服务器机架。(图片由Kang Da-eun提供)


虽然它看起来像是一个普通的数据中心,但这些服务器内部的人工智能半导体却远非寻常。与使用多个小型人工智能芯片(例如英伟达GPU)的系统不同,这个数据中心包含一个晶圆大小的巨型芯片,由美国人工智能芯片制造商Cerebras Systems开发。一位数据中心负责人解释说:“这颗芯片比GPU大58倍,人工智能计算速度快15倍。它是目前速度最快的人工智能芯片。”


Cerebras 专注于研发能够加速大型 AI 模型“推理”(即生成答案)速度的 AI 半导体。随着需要反复执行搜索、编码和工具调用等操作的 AI 代理数量激增,对能够更快、更高效地处理更多答案的芯片的需求也随之增长,这使得 Cerebras 备受瞩目。本报成为首家探访 Cerebras 总部及其 AI 芯片运行数据中心的韩国媒体。


Cerebras,打造晶圆级人工智能芯片


Cerebras 的核心技术在于制造更大尺寸的芯片。大多数半导体公司会将一块 30 厘米的圆形硅晶圆切割成数百个小芯片,而 Cerebras 则将整个晶圆用作单个芯片。这种芯片形状像一个方形盘子,只修剪了圆形晶圆的边缘,类似于自助餐中使用的大餐盘。


这种设计提高了人工智能推理效率。像GPU这样的小型人工智能芯片需要将大型人工智能模型拆分到数十甚至数百个芯片上,从而造成网络和内存瓶颈。Cerebras通过将处理单元和内存集成到单个芯片上,最大限度地减少了这些瓶颈。由于无需在芯片之间传输数据,它缩短了人工智能生成答案所需的时间。


这款AI芯片比GPU大58倍,速度快15倍图2


Cerebras公司直径30厘米的晶圆级人工智能芯片


得益于这项技术,Cerebras 将 90 万个 AI 计算核心和 44 GB 高速 SRAM 集成到单个芯片上,实现了 21 PB/s 的内存带宽。在 Cerebras 的系统上运行韩国 AI 初创公司 Upstage 的模型“Solar”时,每秒生成超过 2000 个 token,推理速度比传统的基于 GPU 的系统快 15 倍。然而,该芯片也存在一些缺点,例如存储容量相对较小以及制造工艺复杂。


Cerebras 声称其芯片需求正在激增。随着人工智能代理日益融入商业运营,人工智能竞争的焦点已从“模型训练”转向“推理”——即快速提供答案。因此,Cerebras 近期与 OpenAI 签订了一份合同,为其提供 750 兆瓦级的超高速推理基础设施。亚马逊网络服务 (AWS) 也在其人工智能芯片 Trainium 之外,采用了 Cerebras 的系统。Cerebras 首席营销官 Julie Choi 表示:“更快的模型比更智能的模型更为重要。人工智能竞争的标准正在从‘智能’转向‘单位时间智能’。”


当天上午,Cerebras总部继续接待客户和合作伙伴的来访。本月初,该公司与OpenAI在韩国联合举办了一场交流活动,约有5000人申请参加一个仅能容纳300人的场地。崔称此举“象征着市场对快速人工智能的浓厚兴趣”。今年5月,该公司成功完成了半导体公司有史以来规模最大的IPO。


新兴的“芯片混合战略”


人工智能行业正从依赖单一芯片进行所有计算转向“芯片混合”策略,将专用芯片组合起来执行特定任务。GPU负责训练和通用任务,而Cerebras的芯片则擅长低延迟推理。“虽然我们经常被称为‘NVIDIA的竞争对手’,但实际上我们是NVIDIA GPU的补充,”Cerebras表示。


像Groq(该公司开发了用于LLM推理的语言处理单元(LPU),并于去年被NVIDIA收购)和Etched(该公司设计专用于基于Transformer的模型推理的芯片)这样的专业芯片公司也在崛起。在韩国,Rebellions和FuriosaAI正在开发用于人工智能代理的节能芯片。


大型科技公司也在部署自研芯片,与GPU和其他专用芯片配合使用。谷歌使用张量处理单元(TPU),亚马逊使用Trainium系列,微软使用Maia,Meta使用MTIA。


美联社指出,“人工智能芯片市场现在正转向推理专用芯片”,而路透社报道称,“推理市场的竞争将会更加激烈,而且规模还会更大”。


原文链接:

https://www.chosun.com/english/industryen/2026/07/23/JU5A64T3VVGEFD2EY46K7SBGBM/


(来源:编译自chosun


点这里👆加关注,锁定更多原创内容


*免责声明:文章内容系作者个人观点,半导体芯闻转载仅为了传达一种不同的观点,不代表半导体芯闻对该观点赞同或支持,如果有任何异议,欢迎联系我们。


推荐阅读

这款AI芯片比GPU大58倍,速度快15倍图3

喜欢我们的内容就点“在看分享给小伙伴哦~这款AI芯片比GPU大58倍,速度快15倍图4

这款AI芯片比GPU大58倍,速度快15倍图5

声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。 
AI GPU 芯片
more
合见工软与燧原科技本土合作创新 破解AI芯片系统级验证挑战
独立AI原生的办公助手,治好了我的打工焦虑
模型没答错,只是没看表:AAAI这篇时序问答方法让AI学会“穿越时间”找答案
太初元碁WAIC 2026全栈亮相,定义系统级算力竞争新范式
当AI能给出所有标准答案,人如何保持独特?
WAIC上的触觉赛道:抢占灵巧手之外的另一大订单入口
AI PPT一改就崩?MemSlides登顶抱抱脸,让Agent记住你的改稿习惯
一场发布会,一千个人,一次关于NeuroAI的实验
身价11亿美元!梅西成硅谷投资人,投了AI教母
AI重新洗牌下,「输」给了拼多多的投资人
Copyright © 2025 成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号