返回行业动态
模型与产品

英伟达开源 34B 推理型 VLA 模型 Alpamayo 2 Super:开放商用许可,瞄准自动驾驶

8月4日,英伟达 CEO 黄仁勋在社交媒体宣布,正式推出面向自动驾驶的开源推理模型 Alpamayo 2 Super,并在 OpenMDW-1.1 宽松许可协议下开放商业使用。该模型约 34B 参数,由 32B 的 Cosmos 3 Super Reasoner 视觉语言骨干与约 2.3B 参数的扩散动作专家组成,支持多摄像头输入、导航指令与驾驶上下文,通过因果推理链理解复杂场景。模型已在 GitHub(NVlabs/alpamayo2)发布,允许车企、自动驾驶开发商、卡车制造商与供应商微调、开发衍生模型并商业化部署,被业界视为自动驾驶模型开源化的重要一步。

来源:英伟达官方(GitHub NVlabs/alpamayo2 仓库)原标题:NVIDIA Alpamayo 2 Super - open 34B multi-task foundation model for autonomous vehicles查看原文
科技感封面,一辆自动驾驶汽车在道路场景中行驶,车身叠加发光的神经网络连线与数据节点,体现 VLA 模型与驾驶决策主题

图片来源:北京拓实科技原创(AI 生成)

发生了什么

8月4日,英伟达 CEO 黄仁勋在 X 上发文宣布推出面向自动驾驶汽车领域的开源推理模型 Alpamayo 2 Super,并将其在 OpenMDW-1.1 许可协议下向商业用途开放。这是英伟达 Alpamayo 系列中规模最大、能力最强的开放模型,规模约为 Alpamayo 1.5 与 Alpamayo 1 的三倍。

模型构成与能力

Alpamayo 2 Super 是一款约 34B 参数的视觉-语言-动作(VLA)模型,由 32B 参数的 NVIDIA Cosmos 3 Super Reasoner 视觉语言骨干与约 2.3B 参数的基于扩散的动作专家组成,并通过强化学习进行后训练。除基础视觉感知外,模型具备对复杂世界的理解与推理能力,可在行动前进行深度思考。它能处理多摄像头视频输入、导航指令与驾驶上下文,输出车辆行驶轨迹、决策推理链、驾驶意图、训练标注与视觉问答等结果,帮助开发者验证自动驾驶决策过程。

开放策略与行业意义

  • 模型基于 OpenMDW-1.1 许可发布,该协议由 Linux 基金会针对开放模型制定,涵盖微调、衍生模型与商业再分发
  • 面向 Robotaxi、智能汽车与卡车生态:自动驾驶开发商、车企、卡车制造商与供应商可基于自有数据、驾驶策略适配模型
  • 黄仁勋表示开放模型有助于推动自动驾驶系统的安全性与可靠性提升,并称 AI 的下一波浪潮属于机器人

分析与不确定性

此次开源被视为英伟达将自动驾驶从“卖芯片”延伸至“模型生态”的关键动作,可能加速行业从各自闭门研发转向共享基础模型之上的差异化竞争。需要说明的是,模型在真实道路环境中的性能、安全性与商业化落地效果仍有待第三方测试与量产验证,榜单与演示数据主要来自英伟达官方口径。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。