两个平台一次性发完

夏威夷时间 9 月 22 日(北京时间 9 月 23 日凌晨)的 2026 骁龙峰会上,高通发布了第六代骁龙 8 超级至尊版与第六代骁龙 8 至尊版两款移动平台。这是高通第一次在同一代上齐发双旗舰,也是它首批 2nm 制程的手机 SoC;至尊版型号 SM8950,据报由台积电 2nm GAA 工艺打造。

CPU 与 GPU:频率之外的专用单元

  • CPU 首次突破 5.0GHz:2 个 5GHz 超级内核 + 6 个 4GHz 性能内核,官方给的提升是性能 +13%、能效 +37%、响应速度 +15%;
  • GPU 换用新架构的 Adreno,并第一次加入面向 AI 的 Matrix Cores;
  • 共享内存扩容 50%——对端侧跑大模型来说,这比纯算力数字更关键。

与 AI 最相关的是 NPU 口径

高通给出的旗舰指标是 Hexagon NPU 支持 300 亿参数的 MoE 模型。这个数字要对照着读:MoE 每次只激活一小部分专家,所以「支持 30B MoE」不等于「30B 稠密模型能跑」,实际可用规模取决于你保留几路专家、量化到什么精度、上下文留多长。反过来讲,这也是厂商开始按「常见端侧架构」报指标而不是按稠密参数量报的原因。

首发与独占期

小米 18 Pro 首发第六代骁龙 8 至尊版,并有约半年的独占期;小米给出的场景数字是高负载手游单帧功耗降低 38%。独占期对开发者不是八卦,而是一个产能事实:接下来半年里,这一档芯片的真实装机量几乎等于这一款机型的销量,端侧功能的灰度节奏要按它排。

该关注什么

  • 端侧模型的实测边界(不是发布会数字):能跑多大的量化模型、首 token 延迟、内存峰值;
  • Matrix Cores 对推理吞吐的实际贡献,需要第三方在同一模型、同一精度下做对比;
  • 独占期结束后的铺开速度——它决定端侧 AI 功能能不能变成「大多数用户」的体验,而不只是旗舰演示。
这一代的关键词是「重造架构为智能体」:CPU 频率是给手机看的,NPU 与内存带宽才是给模型看的。