苹果公司今天发布了搭载于全新 Mac mini 中的 M6 处理器和搭载于全新 Mac Studio 中的 M5 Ultra 处理器,在性能和人工智能方面实现了显著飞跃。
当中,M6 是苹果首款采用 2 纳米制程工艺的尖端芯片,全面提升了每个计算模块的性能,实现了全方位性能的飞跃。该芯片配备了更大的 12 核 CPU 复合体(包含全球速度最快的 CPU 核心)、更大的 12 核 GPU(配备神经加速器)、双 16 核神经网络引擎,以及高达 170GB/s 的统一内存带宽。
M5Ultra 则是一款专业和人工智能工作负载的终极强劲处理器,它采用新一代 UltraFusion 技术,首次在 M 系列系统级芯片 (SoC) 中实现了四芯片架构。该芯片包含高达 36 核的 CPU 和高达 80 核的 GPU,以及高达 1.2TB/s 的统一内存带宽,比 M3 Ultra 提升了 50%。凭借其先进的技术,这些 SoC 提供卓越的计算能力和业界领先的能效,使用户能够在台式机上完成更多工作。
“今天,我们隆重推出苹果芯片在性能和人工智能计算方面实现的又一次巨大飞跃:性能极其先进的 M6 芯片和迄今为止最强大的 M 系列芯片 M5 Ultra,”苹果公司硅工程集团副总裁 Sri Santhanam 表示。
“M6 采用先进的 2 纳米工艺制造,集成了全新的 CPU 复合体、两个额外的 CPU 和 GPU 核心、双 16 核神经网络引擎以及更高的统一内存带宽,能够以惊人的能效轻松应对各种工作负载。而 M5 Ultra 则配备了强大的 GPU(现已搭载神经网络加速器)和更高的统一内存带宽,带来极致的桌面性能和运行大型 AI 模型的能力,进一步突破了桌面电脑的性能极限。”
M6:优化设计,性能提升
M6 旨在为日常用户、学生、开发人员、人工智能爱好者和企业提供强大的工作流程支持,在性能、能效和设备端人工智能之间实现了理想的平衡,可轻松完成日常任务、编码和创意项目。
M6 采用先进的 2 纳米工艺制造,在更小的芯片面积内集成了更高的晶体管密度,从而显著提升了性能和能效。M6 还引入了双 16 核神经网络引擎,其峰值计算能力比上一代产品提升高达两倍,使设备端 AI 工作流程运行速度更快。系统框架可以自动同时利用这两个引擎,从而加快应用程序的模型执行速度。
M6 搭载全新的 12 核 CPU 复合体——比 M5 多两个核心——由 2 个超级核心、4 个性能核心和 6 个能效核心组成。它拥有全球最快的单线程性能,多线程性能比 M5 快 1.2 倍,比 M1 快 2.4 倍。
其中,超级核心能够疾速处理单线程工作负载,性能核心功耗更低,并与超级核心协同运行高要求的多线程工作负载,而能效核心则负责处理日常后台任务——所有这些都拥有业界领先的每瓦性能。因此,图像编辑、代码编译、文件索引和运行智能 AI 工作负载等高 CPU 要求任务的速度比以往任何时候都更快。
加速的GPU和更快的内存带宽
M6 搭载 12 核 GPU(比 M5 多两个核心),每个核心都配备神经加速器。与 M5 相比,这种设计使 AI 的峰值 GPU 计算能力提升近 30%,与 M1 相比提升超过 8 倍,从而在与设备端 LLM 交互时能够显著加快响应速度。
此外,M6 还搭载了苹果最新的高级图形处理功能,包括着色器核心架构的更新、动态缓存和硬件加速光线追踪。这些技术的结合,为游戏带来惊艳的视觉真实感、更快的渲染速度和更高的帧速率。M6 的复杂图形处理速度也提升了 50%。
M6 支持高达 32GB 的统一内存,可同时运行多个高负载应用,并在设备上运行 LLM,以实现安全私密的代理任务。它还提供高达 170GB/s 的统一内存带宽——比 M5 提升 10%,比 M1 提升 2.5 倍。
M5 Ultra:专业工作流程的终极动力源
M5 Ultra 是苹果迄今为止最强大的芯片,专为需要快速处理对 CPU 和 GPU 性能以及统一内存带宽有极高要求的工作负载的专业人士而设计,例如复杂的 3D 渲染、视觉特效、科学分析以及在设备上运行计算密集型前沿 AI 模型。
M5 Ultra 采用 UltraFusion 技术,将两颗双芯片 M5 Max 连接起来,形成四芯片架构——这在苹果芯片中尚属首次。UltraFusion 将芯片间带宽提升至 4.4TB/s 以上,连接密度提升 6 倍以上。这些超低延迟、高带宽的互连技术,使得四颗芯片能够像一个统一的处理器一样运行。M5 Ultra 还配备了一颗强大的 CPU,最多可达 36 核,包含 12 个超级核心和 24 个性能核心,其单线程性能比 M3 Ultra 提升高达 1.25 倍,多线程性能提升高达 1.3 倍。
前所未有的AI和图形技术,海量内存容量
M5 Ultra 搭载新一代 GPU,拥有多达 80 个核心,每个核心都集成了一个神经加速器,与 M3 Ultra 相比,其 AI 峰值 GPU 计算能力提升高达 4.5 倍,与 M1 Ultra 相比更是提升 6 倍以上。该 GPU 包含 Apple 最新的着色器核心,配备第二代动态缓存、硬件加速网格着色和第三代光线追踪技术,图形性能比 M3 Ultra 提升高达 40%。
M5 Ultra 搭载了功能更强大的媒体引擎。它配备了专用的硬件加速 H.264、HEVC 和四个 ProRes 编码解码引擎,以及硬件加速的 AV1 解码,使其成为高分辨率视频编辑的终极解决方案。M5 Ultra 还包含一个 32 核神经网络引擎,能够安全地在设备上运行复杂的 AI 任务和 Apple 智能功能,并拥有业界领先的能效。
此外,M5 Ultra 还配备了高达 512GB 的海量高带宽统一内存,并提供惊人的 1.2TB/s 统一内存带宽,比 M3 Ultra 高出 50%。这使用户能够将海量数据集完全存储在本地内存中,提高每秒令牌数,并在设备上完全运行包含数千亿个参数的大型 LLM。
释放开发者的力量
苹果的开发者框架和工具——包括 Core AI、Core ML、Metal 和 Xcode——可以直接利用这两款芯片的先进硬件。开发者可以利用 M6 芯片中的双 16 核神经网络引擎,以及 M5 Ultra 芯片中 GPU 的神经网络加速器、高达 512GB 的统一内存池和 1.2TB/s 的统一内存带宽,从而提供强大的 AI 计算能力。
借助这些框架和新型芯片,开发者可以在 Mac 本地运行和微调大型 AI 模型。Apple 的开发者工具和框架可自动优化 CPU、GPU 和神经网络引擎的性能,并使开发者能够使用 Apple Foundation 模型、App Intents 来调用 Apple Intelligence 功能,或使用他们自己的专有 AI 模型,从而在设备上构建和运行强大的 AI 工作负载。