苹果自研芯片史上首次,A20 Pro搭载了双16核神经网络引擎,专为处理AI工作负载而设计,性能远超此前任何一款SoC。简而言之,这是一次我们认为并非必需的升级,但如果你想在智能手机上运行端侧AI模型,它绝对至关重要。在最新的演示中,一台iPhone 18 Pro运行270亿参数模型的速度达到了iPhone 17 Pro的两倍。

27B-AI-model-running-on-an-iPhone-18-Pro.jpeg

双16核神经网络引擎在token生成方面确实更快,但内存配置受限的后果意味着,2比特量化的AI模型体积过大,无法在iPhone 18 Pro上运行。

鉴于iPhone 18 Pro和iPhone 18 Pro Max均配备12GB 96位LPDDR5X内存,速度显著快于iPhone 17 Pro和iPhone 17 Pro Max的配置,这一升级加上双16核神经网络引擎的加入,将端侧AI性能推向了新的高度。阿德里安·格龙丹(Adrien Grondin)通过在iPhone 18 Pro上运行Bonsai 27B展示了这些提升,你可以清楚地看到token生成速度有多快。

当然,虽然对于iPhone来说,在没有网络连接的情况下运行更密集的270亿参数AI模型是一大进步,但用户也会面临一些取舍。首先,在X平台的帖子中提到,随着Bonsai 2的发布,还有什么必要继续运行Bonsai?答案令人失望,但这正是在智能手机上运行AI模型的残酷现实:采用2比特量化的Bonsai 2体积太大,无法在iPhone 18 Pro上本地运行,导致性能下降。

iPhone 18 Pro在端侧AI方面的表现远超我的预期。它能以iPhone 17 Pro两倍的速度运行270亿参数模型。新的A20 Pro芯片是一头猛兽。——阿德里安·格龙丹(@adrgrondin)2026年9月19日

由于Bonsai是1比特量化的AI模型,它可以在4GB内存的设备上轻松运行,而在配备8GB甚至12GB内存的手机上,更是如鱼得水。在iPhone 18 Pro上,它不仅搭载了A20 Pro,还拥有极速内存、115.2GB/s的统一内存带宽,以及双16核神经网络引擎——在专为NPU设计的工作负载中,其峰值吞吐量甚至超过该SoC的7核GPU——Bonsai 27B不会出现任何降速迹象。

希望当苹果在未来产品中转向更大的内存配置时,我们能看到更密集的模型得到支持。


文章标签: #苹果 #APro #端侧AI #神经网络 #iPhone
菠萝老师先生

负责编辑

  菠萝老师先生 

  让你的每一个瞬间都充满意义地生活,因为在生命的尽头,衡量的不是你活了多少年,而是你如何度过这些年。