英伟达于 2026 年 8 月 4 日宣布,其面向自动驾驶与 Robotaxi 的开源推理模型 Alpamayo 2 Super 现已开放商用许可。该模型属于 Alpamayo 系列,是 Hugging Face 上被采用最多的自动驾驶开源推理模型,此次开放意味着开发者、车企、卡车制造商及供应商可直接将其用于商业部署,无需额外授权。
Alpamayo 2 Super 基于英伟达 Cosmos 3 Super Reasoner 构建,并通过强化学习进行后训练。其核心突破在于处理自动驾驶中的“长尾事件”——那些罕见、复杂且难以预料的交通场景。模型不仅需要识别物体和预测运动,还需理解情境、推理因果关系、选择正确动作并规划安全舒适的路径,且整个过程需实时完成,并让开发者能够检查、验证和信任。
在许可方面,Alpamayo 2 Super 采用 Linux 基金会的 OpenMDW-1.1 许可,这是一种宽松的开源 AI 模型分发许可,允许微调、衍生模型和商业再分发。这意味着开发者可以基于自身数据、驾驶策略和部署方案对模型进行定制,同时保留对数据和基础设施的控制权。此前 Alpamayo 系列仅用于研发,如今整个模型家族都已应用该许可,为从适配到部署提供了直接路径。
在性能上,Alpamayo 2 Super 在自动驾驶推理基准 LingoQA 上排名第一,在近 40 个评估模型中领先。英伟达测试显示,其 Lingo-Judge 指标分别比 Qwen2.5-VL 72B 高 17.0 分、比 Gemini 2.5 Pro 高 15.1 分、比 GPT-4o 高 23.2 分。此外,该模型在英伟达评估的所有自动驾驶基准中均排名第一。其参数规模是 Alpamayo 1.5 和 Alpamayo 1 的 3 倍,更强的泛化能力有助于处理稀疏样本中的多智能体交互。模型支持 360 度环视摄像头输入,融合前后左右视角,从而更全面地理解变道、合流、无保护转弯及复杂路口等高风险场景。
Alpamayo 2 Super 作为多任务基础模型,可为每个驾驶场景生成五种紧密关联的输出:规划轨迹、因果链(CoC)推理轨迹、元动作(如让行、变道、停车)、用于训练和验证的推理自动标注,以及带有 2D 视觉定位的视觉问答响应。这些输出使开发者能将模型观察到的内容与所选动作关联起来,便于理解、评判和验证决策。因果链轨迹可集成到英伟达 Halos 安全验证工作流中,并支持符合 ISO/PAS 8800 要求的 AI 安全,为自动驾驶安全工程提供更强基础。
在部署策略上,Alpamayo 2 Super 适用于云端开发工作流,可生成高质量推理轨迹、合成训练数据和教师输出,用于模型蒸馏。而 Alpamayo 1.5 和 Alpamayo 1 则提供更具成本效益的云端开发和蒸馏选项。蒸馏后的模型可优化用于量产车辆中的实时推理,形成从云端到汽车的完整工作流——云端提供前沿级推理,车内运行高效专用模型,从而以更可持续的方式将安全自动驾驶扩展到商业车队。
英伟达表示,开放 Alpamayo 2 Super 的商用许可,旨在扩大自动驾驶领域开源模型、数据集和工具的获取,增强竞争,让开发者拥有更大控制权,并支持更安全、更透明的自动驾驶部署。这一举措有望加速 Robotaxi 和自动驾驶汽车从研发走向量产和规模化部署。