高通今年有点反常。往年新一代旗舰平台的细节都是留到骁龙峰会当天一次性放完,今年却在峰会开幕前大半个月,分三次把 CPU、GPU 和 NPU 的架构都交了出来。
这款平台就是骁龙 8 Elite Gen 6,预计在 9 月 22 日于夏威夷开幕的骁龙峰会上正式发布,会期到 24 日。分标准版与 Pro 版两个型号,其中 Pro 版面向各品牌最顶配的机型。对关注安卓旗舰的人来说,这三份材料里的信息量确实不小。
CPU 第一次摸到 5GHz,但重点在缓存
最抓眼球的数字是主频。新一代 Oryon CPU 里有两颗 Prime 核心的主频被拉到 5GHz,这是手机处理器第一次达到这个频率。高通把功劳归给核心设计本身,而不是单纯的制程红利——两颗 Prime 核各自有独立时钟域,可以单独提频,不用整个集群一起动。
剩下的部分,官方口径是六颗性能核(另有资料给出三丛集 2+3+3 的排布,频率数字也不完全一致,具体规格还是要等峰会当天的官方规格表)。
真正比较有意思的其实是缓存设计。高通这次做了个叫 FlexCache 的东西:把 L2 缓存池化,不再给每个核心分固定的份额,而是按负载动态分配。某颗 Prime 核正在跑重任务时,可以把整个池子都借过来用,其他核心需求上来了再重新分配。
这个思路背后是成本压力在推动。存储芯片价格这一年涨得很凶,把更大的工作集留在片上缓存、减少访问系统内存的次数,等于同时省了带宽和功耗。对普通用户来说,你在意的可能只是「开相机、切应用更快了」,但工程上这比多挤几百兆赫有价值得多。
GPU 里塞进矩阵核心,AI 超分有引擎厂商站台
新一代 Adreno GPU 由三块 1.45GHz 的图形切片、一个命令处理器,以及 18MB 的片上高性能存储组成。这 18MB 是给 GPU 自己用的本地池子,专门放图块和帧缓冲,避免把数据推到系统内存再拉回来。
每块图形切片里都加入了矩阵运算核心。简单说,就是把 AI 算力直接放进渲染管线里,让超分、帧生成这类工作不用离开图形单元就能完成——这条路线桌面上的英伟达和 AMD 已经走了几年,手机端现在算是正式跟上。高通还在做 Adreno Neural Fusion 的软件栈,Unity 和 Unreal 都已经接进去了。这一点可能比芯片本身更重要:手机端做 AI 渲染,历来最大的死因不是算力不够,而是开发者不买账。
官方给出的数字是:相比上代基线功耗改善 12%;在内部演示里开启 Neural Fusion 后功耗节省 40%。厂商自测数据、负载条件没公开,参考着看就好。
NPU 的变化最大:一颗手机芯片想跑 300 亿参数
Hexagon NPU 是这代变化最明显的部分。
首先是新增了一个专为 Transformer 运算设计的元素加速器,和原有的向量、标量单元并行工作。Transformer 是大模型里最吃算力的结构,有了专用硬件,端侧推理的响应会更快。
其次是内存。新一代 NPU 的共享内存比上代增加了约 50%(具体容量未公布),并加入了 KV 缓存加速,支持最长 32K 的上下文。这两项配合起来,直接影响到端侧智能体能不能「记得住」——上下文短,对话历史就得不停截断,多轮任务规划根本做不下去。
最受关注的数字是:这颗 NPU 最多可以运行 300 亿参数的混合专家(MoE)模型,每个 token 大约激活 30 亿参数。MoE 的关键在于只计算被路由到的专家,不去动整个权重集合,再加上闪存到内存的专家分页机制,才让这个数字在手机上勉强站得住。
官方对比数据是:INT4 模型下预填充性能比上代最高提升 50%,首个 token 的生成时间缩短 1.5 秒。同样属于厂商自测,实际体验还得看真机。
把这几块串起来看,高通的思路是把「环境语音常驻拾音交给感知中枢、任务编排交给 CPU、推理分给 GPU 或 NPU」做成一个闭环。说白了就是把数据尽量放在离算力近的地方,少搬运。
2nm 的代价:明年的安卓旗舰可能更贵
工艺上,这一代用的是台积电 2nm 家族的 N2P 工艺。相比 3nm,同性能下功耗约降三成,性能提升大概一成半。
但 2nm 的成本摆在那儿。代工价格高、存储又在涨价,高通已经向客户发出涨价通知。业内的普遍判断是:性能更强的 Pro 版可能只会出现在各品牌最贵的那一两款机型上,常规旗舰跑标准版,价格门槛会被进一步抬高。对普通用户来说,这意味着「旗舰机动辄一万二」的年份可能还要继续。
另外两个可以顺带记一下的点:通信方面用上了 X105 调制解调器和 FastConnect 8800,内存支持 LPDDR5X 与 LPDDR6——后者对端侧大模型的内存带宽意义不小。首批搭载的机型里,小米 18 Pro 系列预计在 9 月底首发并有一段独占期,平板方面则有厂商拿 Pro 版做首发。
网友评论
- 「5GHz 是好看,问题是游戏跑十分钟就降频了,能用多久才是关键。」
- 「端侧 30B 模型听着猛,实际上手机内存先扛不住。」
- 「又是涨价通知,安卓旗舰这几年就没便宜过。」
- 「矩阵核心进 GPU 这事我认可,AI 超分终于有正经硬件了。」
- 「等峰会实测吧,现在全是高通自己说的数字。」
以上评论仅代表网友个人观点,不代表官方立场。



