发生了什么
当地时间8月24日,英伟达宣布面向AI推理的Groq 3 LPX机架进入全面量产阶段,标志着其史上最大收购案的核心技术正式商业化。与此同时,公司公布了新一代Vera Rubin平台的最新性能数据,展示了在智能体时代AI基础设施经济性的重大飞跃。
核心性能数据
在SemiAnalysis AgentX智能体工作负载、运行DeepSeek V4 Pro模型的测试中,Vera Rubin NVL72每兆瓦吞吐量最高达到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。Groq 3 LPX则主打低延迟Token生成,在Gemma 4 31B模型、10万Token上下文测试中达到每秒3400个输出Token。
SpaceXAI将算力延伸至太空
SpaceXAI同日宣布将进一步扩大对英伟达新一代平台的部署,采用Vera CPU支持下一代智能体AI应用,并随着自身算力向数GW规模扩张建设Vera Rubin基础设施。更值得关注的是,SpaceXAI计划将优化版Vera Rubin NVL72用于首代Starmind AI卫星,将英伟达AI计算平台从地面数据中心延伸至轨道计算。
为何重要
英伟达此次发布的核心并非单纯刷新芯片性能,而是重新定义智能体时代AI基础设施的经济性。30倍的吞吐量跃升意味着企业部署AI Agent的成本结构将发生根本性变化。而太空AI计算的落地,则预示着算力部署正在突破地理和物理边界。

