M6 量产落地,反推 A20 Pro 的 2nm、双 Neural Engine 与内存走向

台积电 N2 工艺、双 16 核 Neural Engine、WMCM 封装、LPDDR5X 而非 LPDDR6、AV1 编码继续缺席——M6 已经把这些技术选择摆在桌面上,A20 Pro 大概率会沿用同一套答案。

M6 与 A20 Pro 芯片对照示意

苹果历代 A 系列与 M 系列芯片共享大量架构,所以新 A 系列通常只是后面 M 系列的「部分预告」。但今年顺序反了过来:M6 在 8 月 25 日提前亮相,比本月 iPhone 18 Pro 上预计出现的 A20 Pro 还要早。这个时间点上的「抢跑」,本身就是信号。

最近的报告指出,A20 Pro 相比 A19 Pro 可能带来最高 18% 的性能提升和最高 30% 的能效改善,这与 M6 对 M5 的幅度大致相近。更关键的是制程:M6 是苹果首款采用台积电 2nm(N2)工艺的芯片,第二款几乎确定就是 A20。N2 的晶体管密度更高,苹果能在更小的面积里塞进更多性能。

苹果历史上习惯在 A 系列上首发新制程,用 iPhone 的出货量验证良率,而这一次用 899 美元起的 Mac mini 来打头阵,是个明显的变化。因此,关于 A20 和 A20 Pro 会转向 N2 的传闻,如今已经有出货产品背书,不再只是分析师预测。但这也意味着,iPhone 发布会上那句「苹果首款 2nm 芯片」的营销话,已经用不上了。

神经引擎方面,iPhone 的 Neural Engine 自 A17 Pro 以来一直停留在 16 核、约 35 万亿次运算/秒的水准,横跨三代。M6 引入了双 16 核 Neural Engine,苹果表示系统框架可以同时调用两颗引擎,峰值算力达到前代的两倍。这一变化与报道中提到的 WMCM 封装相对应——把内存与 CPU、GPU、Neural Engine 放在同一晶圆上,缩短数据路径。受芯片面积与散热约束,双引擎可能只出现在 A20 Pro 上。

GPU 方面,苹果曾说 M5 相对 M4 在 AI GPU 算力上提升了 4 倍以上,这源于 GPU 核心内置的 Neural Accelerators。M6 在此基础上再提升近 30%——这是第二代 Neural Accelerators 的打磨而非又一次阶跃。A19 Pro 去年 9 月因为同样的架构原因实现了 4 倍提升,今年 A20 Pro 大概率不会重复那种标题级的数字。M6 还带来了 50% 的几何处理速率提升、更新的着色器核心、修订版 Dynamic Caching 和硬件光线追踪;这些架构变化,历来在同代 A 系列上也会出现对应的图形改进。

内存带宽是跑本地大模型的关键瓶颈。M6 提供最高 170GB/s,苹果称之为比 M5 的 153.6GB/s 提升约 10%。这个幅度足够小,说明苹果用的是同一种 LPDDR5X 里更快的规格,而不是转向更新的 LPDDR6(后者会带来更大的跃升)。有报道指苹果正在为 iPhone 18 系列向三星采购高速 LPDDR5X,与 M6 的情况一致。

对 A20 的暗示是:内存带宽不会有显著跃升。A19 Pro 的带宽是 76.8GB/s,按类似的 10% 提升计算,A20 Pro 大约在 85GB/s 上下。如果 iPhone 18 Pro 在跑本地模型上要出现明显的「更快」体验,更可能来自 WMCM 封装缩短数据路径,而不是内存本身。

最后,M6 的媒体引擎支持 H.264、HEVC、ProRes、ProRes RAW 硬件加速,包含 AV1 解码但不含 AV1 编码,与 M5 一致。在一款新制程的桌面芯片上都缺席,AV1 编码出现在 A20 Pro 上的可能性就更低了。对视频创作者来说,这恐怕是这条技术线上唯一要再继续等的一站。