返回行业动态
算力与基础设施

英伟达Groq 3 LPX全面量产,Vera Rubin推理吞吐量跃升30倍

英伟达宣布面向AI推理的Groq 3 LPX机架全面量产,主打低延迟Token生成。同时公布Vera Rubin NVL72平台性能数据,在智能体工作负载测试中每兆瓦吞吐量达上代GB300的30倍,每Token成本降低最高35倍。SpaceXAI宣布采用Vera CPU并将Vera Rubin部署延伸至太空AI卫星。

来源:英伟达官方 / 每日经济新闻原标题:NVIDIA Groq 3 LPX in Full Production, Vera Rubin NVL72 30x Throughput查看原文
英伟达GPU服务器机架在数据中心中运行,发出绿色光芒

图片来源:北京拓实科技原创

发生了什么

当地时间8月24日,英伟达宣布面向AI推理的Groq 3 LPX机架进入全面量产阶段,标志着其史上最大收购案的核心技术正式商业化。与此同时,公司公布了新一代Vera Rubin平台的最新性能数据,展示了在智能体时代AI基础设施经济性的重大飞跃。

核心性能数据

在SemiAnalysis AgentX智能体工作负载、运行DeepSeek V4 Pro模型的测试中,Vera Rubin NVL72每兆瓦吞吐量最高达到上一代GB300 NVL72的30倍,每Token成本最高降低35倍。Groq 3 LPX则主打低延迟Token生成,在Gemma 4 31B模型、10万Token上下文测试中达到每秒3400个输出Token。

SpaceXAI将算力延伸至太空

SpaceXAI同日宣布将进一步扩大对英伟达新一代平台的部署,采用Vera CPU支持下一代智能体AI应用,并随着自身算力向数GW规模扩张建设Vera Rubin基础设施。更值得关注的是,SpaceXAI计划将优化版Vera Rubin NVL72用于首代Starmind AI卫星,将英伟达AI计算平台从地面数据中心延伸至轨道计算。

为何重要

英伟达此次发布的核心并非单纯刷新芯片性能,而是重新定义智能体时代AI基础设施的经济性。30倍的吞吐量跃升意味着企业部署AI Agent的成本结构将发生根本性变化。而太空AI计算的落地,则预示着算力部署正在突破地理和物理边界。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。