发生了什么
7 月 22 日,在 AMD Advancing AI 2026 大会开幕前夕,NVIDIA 抢先公布了其数据中心 CPU Vera 的完整架构设计。这是继今年 5 月 GTC 大会上宣布 Vera 量产后,NVIDIA 首次向外界详细拆解这款处理器的内部设计。
架构亮点
- 88 个 Olympus 核心,176 SMT 线程,164MB 统一 L3 缓存,1.2TB/s LPDDR5X 内存带宽。
- 每核心采用宽前端设计,集成神经分支预测器(neural branch predictor),每周期最多取 16 条指令,解码宽度 10 路,可同时处理 10 条融合指令。
- 引入内存重命名(memory renaming)、值预测(value prediction)和移动消除(move elimination)技术以减少数据依赖停顿,针对智能体 AI 常见的不规则控制流和长依赖链进行了专门优化。
- Vera Rubin NVL72 平台已进入量产爬坡,OpenAI、Anthropic、SpaceX 及甲骨文云均已部署验证。
- 单线程性能为当前 x86 处理器的 1.6 倍,目标是在高负载插槽满载与高线程密度场景之间灵活切换。
为什么重要
Vera CPU 的完整披露标志着 AI 基础设施竞争从 GPU 算力单维度扩展到 CPU 架构层面。NVIDIA 的核心叙事是:智能体 AI(Agentic AI)的编排层将越来越多的关键执行路径转移到 CPU 上,传统的通用 CPU 架构并未针对此类工作负载进行优化,因此需要从零设计的专用芯片。
对于企业而言,这意味着未来的 AI 推理基础设施可能需要同时评估 CPU 和 GPU 的协同效率,而不是仅关注 GPU 的 FLOPS 指标。Vera + Rubin 的整机方案将使 NVIDIA 从「卖显卡」转向「卖 AI 工厂整机」,这对其与 AMD 和 Intel 的竞争格局以及下游数据中心客户的采购决策都将产生深远影响。

