Arm 发布首个 AI 原生计算底座:手机 GPU 开始自带神经网络了

9 月 8 日,芯片设计公司 Arm 在上海的年度大会上甩出了一个重磅消息:正式发布第二代移动计算平台 Arm CSS for Mobile 2。这个平台最抓眼球的地方,是它带来了一颗「AI 原生」的 GPU,以及一套全新的 CPU 集群——Arm 想用这一整套方案,把手机上的端侧 AI 能力再往前推一大步。

对不搞芯片的人来说,这件事听起来可能有点远。但如果你关心未来一两年新手机「AI 到底好不好用」「打游戏画面能不能更流畅」,那 Arm 这次发布的东西,其实和你关系很大。

首款「AI 原生」GPU,到底特别在哪

Arm 发布首个 AI 原生计算底座:手机 GPU 开始自带神经网络了

这次最大的主角,是 Arm 首款 AI 原生 GPU——Mali G2-Ultra NX。它和以往 GPU 最大的不同,是把专用的神经加速器直接集成进了 GPU 的着色器核心和图形处理流水线里,并且和 GPU 共享内存、缓存和控制结构。

这么做的意义在于:以前要在手机上跑 AI 图形任务,数据得在 GPU 和专门的 AI 加速器之间来回搬运,又慢又费电。现在神经加速器直接「长」在 GPU 里,数据不用搬来搬去,效率自然上去了。Arm 给这种能力起了个名字,叫「神经图形」(Neural Graphics)。

传统图形方面,这颗 GPU 也没落下。相比上一代,它的基准测试性能最高提升 24%,非 AI 游戏性能提升 14%。更重要的是,它带来了 Mali GPU 过去七代以来规模最大的一次指令集架构(ISA)升级,寄存器数量最多翻倍,还集成了第三代硬件光线追踪单元,并加入了对透明度微地图(OMM)的硬件支持,让树叶、织物这类复杂透明物体的光追效率明显提高。

三项神经图形技术,是干什么用的

Arm 发布首个 AI 原生计算底座:手机 GPU 开始自带神经网络了

Arm 把神经图形拆成了三项具体技术,每一项都对应一个真实的使用场景。

第一项叫神经超采样(NSS),简单说就是用 AI 把低分辨率渲染的画面「脑补」成高分辨率,比如把 540p 的画面重建到 1080p,从而省下大量传统渲染的算力。第二项叫神经帧率提升(NFRU),利用渲染帧、运动、深度等数据生成中间帧,让画面更流畅——注意它不是简单地把 30 帧翻倍到 60 帧,实际提升多少得看具体游戏和分辨率。第三项叫神经超采样加降噪(NSSD),专门针对光线追踪这类复杂光照场景,提升画质和效率。

Arm 和游戏开发商 Sumo Digital 合作做了一个叫 Neural Dawn 的演示,展示了 NFRU 和 NSSD 组合的效果:相比原生渲染,神经图形方案最高能实现 4 倍的性能效率提升,同时把外部内存流量降低最多 70%。当然,这些数字来自特定演示,不代表所有游戏都能拿到同样的提升,但方向已经很明确了。

CPU 也来凑热闹:C2 集群 + SME2

Arm 发布首个 AI 原生计算底座:手机 GPU 开始自带神经网络了

光有 GPU 还不够,Arm 这次还带来了全新的 C2 CPU 集群,由旗舰定位的 C2-Ultra 和强调持续效率的 C2-Pro 组成。C2 系列一个关键升级,是加入了对 SME2(可伸缩矩阵扩展 2)的支持,能加速矩阵运算,让 CPU 更高效地处理本地 AI 推理、语音处理和智能体 AI 的工作负载。

数据上,和上一代 C1-Ultra 相比,C2-Ultra 的单线程性能最高提升 15%,网页浏览提速 15%,应用启动提速 12%,多线程性能提升 12%。在 Arm 选定的最新 AI 模型测试里,配合两组 SME2,最高能拿到 1.7 倍的性能提升;在选定 AI 任务上,性能最高提升约 70%,同等性能下功耗还能降 38%。

真正的变化:从「加速器」到「平台」

Arm 发布首个 AI 原生计算底座:手机 GPU 开始自带神经网络了

如果只看单个 CPU 或 GPU,你可能会觉得这不过是一次常规升级。但 Arm 这次的野心,其实在「平台」二字上。

在 Arm 的设计里,CPU 负责通用计算、任务调度和 AI 智能体的工作流编排,GPU 承担图形和神经图形任务,系统互连、内存、软件和工具负责在各个计算单元之间协调数据。也就是说,未来手机上的 AI 应用,很可能不是靠某一块 NPU 或 GPU 单独扛下来,而是多个计算单元一起协作——这对「智能体 AI」(Agentic AI)尤其关键。

因为智能体不像传统问答那样「问一句答一句」,它要持续处理上下文、检索信息、调用应用、执行任务、再根据结果继续推理,计算需求复杂得多,也更依赖 CPU 和其他单元的协同。Arm 推出 CSS for Mobile 2,瞄准的正是这种变化。

对手机厂商和普通用户意味着什么

Arm 发布首个 AI 原生计算底座:手机 GPU 开始自带神经网络了

要泼一点冷水:CSS for Mobile 2 并不是一块你能直接买到的手机芯片,而是一套面向合作伙伴的可配置平台,芯片厂商基于它定制、再集成进自己的 SoC。截至发布,Arm 还没公布采用这套平台的商用 SoC 型号,也没有具体的手机产品。所以从发布到你能在手里摸到搭载它的新手机,中间还有芯片设计、验证、量产、整机开发好几道关要过。

但方向已经很清楚了:未来手机竞争的焦点,会从单纯比 CPU、GPU 的峰值跑分,转向整套平台在持续 AI 负载下的协同效率。对普通用户来说,这意味着下一批旗舰手机在端侧 AI(本地推理、实时翻译、AI 修图)和 AI 增强游戏画面上的体验,很可能会有一个肉眼可见的跃升。而 Arm 这次,等于提前把这张路线图摊开给大家看了,接下来就看哪家芯片厂商先把这块「积木」搭进自家旗舰里了。