返回行业动态
模型与产品

高通发布骁龙 8 Elite Gen 6 系列:台积电 2nm 制程,手机 CPU 首次突破 5GHz

高通在骁龙技术峰会发布骁龙 8 Elite Gen 6 与定位更高的 Extreme Gen 6,均为台积电 2nm 制程,Oryon CPU 由 2 颗最高 5GHz 超大核与 6 颗最高 4GHz 性能核组成,高通称是首个突破 5GHz 的移动 CPU。标准版 CPU、GPU、NPU 分别提升 10%、35%、14%,Extreme 版为 13%、44%、35%,可在端侧运行超过 300 亿参数的 MoE 模型。小米 18 Pro 系列首发。

来源:高通骁龙峰会发布:骁龙 8 Elite Gen 6 与骁龙 8 Elite Extreme Gen 6 移动平台原标题:Snapdragon 8 Elite Gen 6 Mobile Platform查看原文
半导体洁净室黄光区纵深画面,成排光刻设备与管道延伸,中景机械臂搬运表面光滑无标识的晶圆载具,前景金属地面反光,琥珀色与深青色对比,顶部居中有一行中文字标题

图片来源:北京拓实科技原创(AI 生成封面)

发生了什么

高通于当地时间 9 月 22 日在骁龙技术峰会上发布第六代骁龙 8 至尊版与定位更高的第六代骁龙 8 超级至尊版两款移动平台。两者均采用台积电 2 纳米制程,搭载高通自研 Oryon CPU,由 2 颗最高 5GHz 的超大核与 6 颗最高 4GHz 的性能核组成,高通称这是首个主频突破 5GHz 的移动 CPU。这是高通首次同时推出两款顶级旗舰平台,标准版覆盖更广的高端机型,Extreme 版面向重载本地 AI 与专业影像场景。小米 18 Pro 系列为首发终端,小米、vivo、OPPO、荣耀、摩托罗拉等厂商确认将陆续导入。

关键指标

  • CPU:标准版性能提升 10%、Extreme 版提升 13%,两版本能效均提升 37%,配备 16MB Flex Cache;
  • GPU:标准版提升 35%、Extreme 版提升 44%,能效提升 40%;Extreme 版新增矩阵核心与 Adreno Neural Fusion,可在图形管线内执行 AI 超分与帧生成;
  • NPU:标准版性能提升 14%、Extreme 版提升 35%,AI 每瓦性能分别提升 20% 与 33%;Extreme 版 NPU 共享内存子系统扩大 50%,INT4 模型预填速度最高提升 50%;
  • 精度支持:新增 Hexagon Element Accelerator,支持 INT2、INT4、INT8、INT16、FP8、FP16 精度阶梯;
  • 端侧模型:可在设备上运行参数规模超过 300 亿的混合专家模型,单次激活约 30 亿参数;高通与阶跃、无量火、江波龙合作适配 StepEdge-Omni 30B-MoE;
  • 连接:搭载 X105 5G 调制解调器,下行峰值 14.8Gbps,上行 4.2Gbps,支持卫星非地面网络。

高通把这一代的产品叙事定义为智能体 AI:升级后的 Sensing Hub 以低功耗持续处理语音与环境信息,与 CPU、NPU 协同,按用户意图规划并执行跨应用的多步骤任务,并通过端侧学习适配照片滤镜、裁剪与消息写作风格。对做端侧部署的团队来说,真正的变化在内存与精度两处。Extreme 版把 NPU 共享内存子系统扩大 50%,直指语言模型的带宽瓶颈——激活值与键值缓存留在片内的时间越长,往返内存的次数越少,时延与功耗同时下降;而从 INT2 到 FP16 的完整精度阶梯,允许开发者按任务选择质量与开销的交换点。

对企业 IT 而言,端侧推理能力的抬升带来一个实际的架构问题:哪些推理放在终端、哪些留在云端。可离线运行、数据不出设备的场景适合下沉到端侧,例如现场巡检、涉密环境与网络覆盖不佳的作业面;需要长上下文、跨系统数据整合或最新知识支撑的任务,仍然要回到云端。混合架构的取舍点,正在从「终端能不能跑」变成「单位任务成本与服务等级如何权衡」。

不确定之处

三点需要保留判断。第一,可运行 300 亿参数混合专家模型描述的是能力上限而非普遍体验,模型体积、内存带宽与散热仍是硬约束,高通举出的例子是单次仅激活约 30 亿参数的情况。第二,GPU 矩阵核心带来的 AI 超分与帧生成需要游戏开发者适配,实际落地范围取决于生态跟进速度。第三,制程与产能仍是变量:高通表示已公布的 2 纳米产品均由台积电代工,同时未排除未来与三星代工合作,产能分配与良率会直接影响终端上市节奏。同期联发科天玑 9600 Pro 与苹果 A20 Pro 也采用 2 纳米制程,移动端算力竞争已整体跨过这一节点。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。