发生了什么
高通于当地时间 9 月 22 日在骁龙技术峰会上发布第六代骁龙 8 至尊版与定位更高的第六代骁龙 8 超级至尊版两款移动平台。两者均采用台积电 2 纳米制程,搭载高通自研 Oryon CPU,由 2 颗最高 5GHz 的超大核与 6 颗最高 4GHz 的性能核组成,高通称这是首个主频突破 5GHz 的移动 CPU。这是高通首次同时推出两款顶级旗舰平台,标准版覆盖更广的高端机型,Extreme 版面向重载本地 AI 与专业影像场景。小米 18 Pro 系列为首发终端,小米、vivo、OPPO、荣耀、摩托罗拉等厂商确认将陆续导入。
关键指标
- CPU:标准版性能提升 10%、Extreme 版提升 13%,两版本能效均提升 37%,配备 16MB Flex Cache;
- GPU:标准版提升 35%、Extreme 版提升 44%,能效提升 40%;Extreme 版新增矩阵核心与 Adreno Neural Fusion,可在图形管线内执行 AI 超分与帧生成;
- NPU:标准版性能提升 14%、Extreme 版提升 35%,AI 每瓦性能分别提升 20% 与 33%;Extreme 版 NPU 共享内存子系统扩大 50%,INT4 模型预填速度最高提升 50%;
- 精度支持:新增 Hexagon Element Accelerator,支持 INT2、INT4、INT8、INT16、FP8、FP16 精度阶梯;
- 端侧模型:可在设备上运行参数规模超过 300 亿的混合专家模型,单次激活约 30 亿参数;高通与阶跃、无量火、江波龙合作适配 StepEdge-Omni 30B-MoE;
- 连接:搭载 X105 5G 调制解调器,下行峰值 14.8Gbps,上行 4.2Gbps,支持卫星非地面网络。
高通把这一代的产品叙事定义为智能体 AI:升级后的 Sensing Hub 以低功耗持续处理语音与环境信息,与 CPU、NPU 协同,按用户意图规划并执行跨应用的多步骤任务,并通过端侧学习适配照片滤镜、裁剪与消息写作风格。对做端侧部署的团队来说,真正的变化在内存与精度两处。Extreme 版把 NPU 共享内存子系统扩大 50%,直指语言模型的带宽瓶颈——激活值与键值缓存留在片内的时间越长,往返内存的次数越少,时延与功耗同时下降;而从 INT2 到 FP16 的完整精度阶梯,允许开发者按任务选择质量与开销的交换点。
对企业 IT 而言,端侧推理能力的抬升带来一个实际的架构问题:哪些推理放在终端、哪些留在云端。可离线运行、数据不出设备的场景适合下沉到端侧,例如现场巡检、涉密环境与网络覆盖不佳的作业面;需要长上下文、跨系统数据整合或最新知识支撑的任务,仍然要回到云端。混合架构的取舍点,正在从「终端能不能跑」变成「单位任务成本与服务等级如何权衡」。
不确定之处
三点需要保留判断。第一,可运行 300 亿参数混合专家模型描述的是能力上限而非普遍体验,模型体积、内存带宽与散热仍是硬约束,高通举出的例子是单次仅激活约 30 亿参数的情况。第二,GPU 矩阵核心带来的 AI 超分与帧生成需要游戏开发者适配,实际落地范围取决于生态跟进速度。第三,制程与产能仍是变量:高通表示已公布的 2 纳米产品均由台积电代工,同时未排除未来与三星代工合作,产能分配与良率会直接影响终端上市节奏。同期联发科天玑 9600 Pro 与苹果 A20 Pro 也采用 2 纳米制程,移动端算力竞争已整体跨过这一节点。

