Apple 发布 M6 与 M5 Ultra 芯片:性能与 AI 算力的大跃进

发布于 · 2,490 字 · 约 6 分钟#M7#翻译原文链接
Apple 发布 M6 与 M5 Ultra 芯片:性能与 AI 算力的大跃进 封面图
  • M6 采用 2nm 制程,12 核 CPU 与 12 核 GPU 带来性能与能效重大跃升
  • M6 配备双 16 核神经网络引擎,AI 峰值算力提升至前代 2 倍
  • M5 Ultra 采用四芯粒架构,最高 36 核 CPU 和 80 核 GPU
  • M5 Ultra 提供 1.2TB/s 内存带宽,支持 512GB 统一内存运行超大 AI 模型
Apple M6 芯片与 M5 Ultra 芯片标识
Apple M6 芯片与 M5 Ultra 芯片标识

M6 带来日常性能与能效的革命性跃升。M5 Ultra 则释放出前所未有的台式机级算力和海量统一内存带宽,征服最苛刻的项目。

Apple 今日在新款 Mac mini 中首发 M6,并在新款 Mac Studio 中首发 M5 Ultra,实现性能与 AI 能力的巨大飞跃。M6 是 Apple 首款采用尖端 2 纳米制程的芯片,每个计算模块全面进化,性能在各个维度上都有提升。这颗芯片配备更大的 12 核 CPU 复合体(内含全球最快的 CPU 核心)、带神经网络加速器(Neural Accelerators)的更大 12 核 GPU、双 16 核神经网络引擎(Dual 16-core Neural Engine),以及最高 170GB/s 的统一内存带宽1。M5 Ultra 则是专业与 AI 工作负载的终极 powerhouse,采用下一代 UltraFusion 封装技术,首次在 M 系列系统级芯片(SoC)中构成四芯粒(quad-die)架构。它包含最高 36 核 CPU 和最高 80 核 GPU,拥有高达 1.2TB/s 的统一内存带宽,比 M3 Ultra 高出 50%。凭借这些先进技术,两颗 SoC 以行业领先的能效带来非凡算力,让用户在桌面上做到更多。

「今天,我们为 Apple 芯片带来性能与 AI 算力的下一次巨大飞跃,推出了极其先进的 M6,以及迄今最强大的 M 系列芯片 M5 Ultra。」Apple 芯片工程集团副总裁 Sri Santhanam 表示,「M6 采用尖端的 2nm 制程打造,结合全新 CPU 复合体、新增的两个 CPU 核心与两个 GPU 核心、双 16 核神经网络引擎以及更多统一内存带宽,以出色的能效驰骋各类工作负载。而对于极致的台式机性能和运行超大 AI 模型的需求,M5 Ultra 配备了超大 GPU(现已内置神经网络加速器)和更多统一内存带宽,把台式机的能力边界再往前推。」

M6:优化设计与性能增强

M6 为日常用户、学生、开发者、AI 爱好者和企业的工作流而生,在性能、能效和端侧 AI 之间取得理想平衡,轻松搞定日常任务、编程和创意项目。

M6 采用尖端的 2nm 制程工艺,在更小的芯片面积里塞进更高的晶体管密度,实现性能与能效的重大跃升。M6 还引入双 16 核神经网络引擎,峰值算力最高达到前几代的 2 倍,让端侧 AI 工作流跑得更快。系统框架可以自动同时调用两颗引擎,应用的模型执行速度因此更快。

Mac Studio 与 Studio Display 上正在 Adobe Photoshop 中编辑彩色抽象插图
Mac Studio 与 Studio Display 上正在 Adobe Photoshop 中编辑彩色抽象插图

搭载全新 2nm M6 的 Mac mini,在 Adobe Photoshop 这类应用中为创意工作流提供极其快速流畅的体验。

M6 拥有全新的 12 核 CPU 复合体,比 M5 多出两个核心,由 2 个超级核、4 个性能核和 6 个能效核组成。它提供全球最快的单线程性能,多线程性能最高可达 M5 的 1.2 倍、M1 的 2.4 倍2。超级核闪电般处理单线程工作负载,性能核以更低功耗加入超级核共同应对苛刻的多线程任务,能效核则负责日常后台事务,三者都以行业领先的每瓦性能运行。修图、编译代码、索引新文件、跑智能体(agentic)AI 工作负载这类高 CPU 需求的任务,都因此比以往更快。

GPU 加速与更快内存带宽

M6 配备 12 核 GPU,同样比 M5 多出两个核心,每个核心都内置神经网络加速器。这一设计让 AI 场景的 GPU 峰值算力较 M5 提升近 30%,较 M1 提升超过 8 倍,与端侧 LLM 交互时的提示词处理显著加快2。

Mac Studio 与 Studio Display 上展示游戏 Mixtape 的电影化场景
Mac Studio 与 Studio Display 上展示游戏 Mixtape 的电影化场景

M6 拥有更强大的 12 核 GPU,提供更高几何吞吐和更新的动态缓存(Dynamic Caching),在 Mixtape 这类高要求游戏中呈现惊艳视效与流畅帧率。

此外,M6 提供 Apple 最新的先进图形能力,包括更新的着色器核心架构、动态缓存和硬件加速光线追踪。这些技术结合起来,为游戏带来惊艳的视觉真实感、更快的渲染速度和更高的帧率。M6 的几何吞吐率还提升了 50%,应对复杂图形更从容。

M6 支持最高 32GB 统一内存,可以在高需求应用之间多任务切换,并在设备上运行 LLM,保障智能体任务的安全与隐私。它还提供最高 170GB/s 的统一内存带宽,较 M5 提升 10%,是 M1 的 2.5 倍。

Mac Studio 与 Studio Display 上正在 Xcode 中编写代码
Mac Studio 与 Studio Display 上正在 Xcode 中编写代码

凭借双 16 核神经网络引擎、带神经网络加速器的更大 GPU 和更高的统一内存带宽,M6 让开发者以惊人的速度在 Xcode 中编译代码、索引文件并运行多个模拟器。

M5 Ultra:专业工作流的终极猛兽

M5 Ultra 是 Apple 迄今最强大的芯片,为需要极限 CPU 与 GPU 性能以及统一内存带宽的专业人士而生,比如复杂 3D 渲染、视觉特效、科学分析,以及在设备上运行计算密集的前沿级 AI 模型。

Mac Studio 与 Studio Display 上正在 Adobe Premiere Pro 中编辑视频时间线
Mac Studio 与 Studio Display 上正在 Adobe Premiere Pro 中编辑视频时间线

搭载 M5 Ultra 的 Mac Studio 提供极致性能与内存带宽,在 Adobe Premiere Pro 中剪辑包含多路高分辨率视频流与特效的复杂时间线。

M5 Ultra 使用 UltraFusion 连接两颗双芯粒 M5 Max,构成四芯粒架构,这在 Apple 芯片中尚属首次。UltraFusion 把芯粒间带宽提升到超过 4.4TB/s,连接密度提升超过 6 倍。这些超低延迟、高带宽的互连让四个芯粒表现为一颗统一的处理器。M5 Ultra 还配备最高 36 核的大规模 CPU,包含 12 个超级核和 24 个性能核,单线程性能最高比 M3 Ultra 高 1.25 倍,多线程性能最高高 1.3 倍3。

M5 Ultra 搭载下一代 GPU,最高 80 核,每个核心都内置神经网络加速器,AI 场景的 GPU 峰值算力最高可达 M3 Ultra 的 4.5 倍、M1 Ultra 的 6 倍以上3。这颗 GPU 采用 Apple 最新的着色器核心,配备第二代动态缓存、硬件加速网格着色(mesh shading)和第三代光线追踪,图形性能最高比 M3 Ultra 快 40%3。

Mac Studio 与 Studio Display 上正在 Draw Things 应用中编辑树屋图像
Mac Studio 与 Studio Display 上正在 Draw Things 应用中编辑树屋图像

凭借带神经网络加速器的最高 80 核 GPU,搭载 M5 Ultra 的 Mac Studio 让创作者用 Draw Things 这类应用在本地生成高质量 AI 图像。

M5 Ultra 集成了更强大的媒体引擎。专用的硬件级 H.264、HEVC、四组 ProRes 编解码引擎,以及硬件加速 AV1 解码,使其成为高分辨率视频剪辑的终极方案。M5 Ultra 还包含 32 核神经网络引擎,以行业领先的能效在设备上安全驱动复杂 AI 任务与 Apple Intelligence 功能4。

Mac Studio 与 Studio Display 上展示 LM Studio Bionic 与 MATLAB 中的复杂数据可视化与图表
Mac Studio 与 Studio Display 上展示 LM Studio Bionic 与 MATLAB 中的复杂数据可视化与图表

凭借最高 512GB 统一内存和 1.2TB/s 内存带宽,搭载 M5 Ultra 的 Mac Studio 让研究人员用 LM Studio Bionic 调用本地 AI 模型,触发 MATLAB 中的复杂模拟。

另外,M5 Ultra 拥有海量的高带宽统一内存,最高 512GB,并提供惊人的 1.2TB/s 统一内存带宽,比 M3 Ultra 高 50%。用户可以把庞大数据集完整放进本地内存,提高每秒 token 数,并完全在设备上运行数千亿参数的超大 LLM。

为开发者释放算力

Apple 的开发者框架与工具(包括 Core AI、Core ML、Metal 和 Xcode)直接吃透两颗芯片的先进硬件。开发者可以利用 M6 的双 16 核神经网络引擎,以及 M5 Ultra GPU 中的神经网络加速器、海量 512GB 统一内存池和更快的 1.2TB/s 统一内存带宽,获得惊人的 AI 算力。

借助这些框架和新芯片,开发者可以在 Mac 上本地运行并微调大型 AI 模型。Apple 的开发者工具与框架会自动在 CPU、GPU 和神经网络引擎之间优化性能,开发者既可以使用 Apple Foundation Models 和 App Intents 来接入 Apple Intelligence 功能,也可以用自己的专有 AI 模型,完全在设备上构建和运行强大的 AI 工作负载。

注解

  1. 测试由 Apple 于 2026 年 8 月使用出货的竞品系统和选定的行业标准基准完成。 ↩

  2. 测试由 Apple 于 2026 年 8 月使用预量产设备完成,包括配备 12 核 CPU、12 核 GPU 和 32GB 内存的 M6 版 Mac mini;配备 10 核 CPU、10 核 GPU 和 32GB 内存的 M5 版 14 英寸 MacBook Pro;以及配备 8 核 CPU、8 核 GPU 和 16GB 内存的 M1 版 Mac mini。性能通过选定的行业标准基准测量,测试基于特定计算机系统,反映 Mac mini 的近似性能。更多信息见 apple.com/mac-mini。 ↩ ↩2

  3. 测试由 Apple 于 2026 年 8 月使用预量产设备完成,包括配备 36 核 CPU、80 核 GPU 和 256GB 内存的 M5 Ultra 版 Mac Studio;配备 32 核 CPU、80 核 GPU 和 256GB 内存的 M3 Ultra 版 Mac Studio;以及配备 20 核 CPU、64 核 GPU 和 64GB 内存的 M1 Ultra 版 Mac Studio。性能通过选定的行业标准基准测量,测试基于特定计算机系统,反映 Mac Studio 的近似性能。更多信息见 apple.com/mac-studio。 ↩ ↩2 ↩3

  4. Apple Intelligence 功能目前可通过 Apple Beta Software Program 测试,今秋随 macOS 27 面向启用了 Apple Intelligence 且语言设置受支持的设备推出。支持语言包括英语、丹麦语、荷兰语、法语、德语、意大利语、挪威语、葡萄牙语、西班牙语、瑞典语、土耳其语、越南语、中文(简体与繁体)、日语和韩语。部分功能可能因地区和语言而异。功能与语言可用性及系统要求详见 apple.com/apple-intelligence。 ↩

评论互动

© 2026 王若风的技术博客 · Powered by Astro