英伟达(NVIDIA)现已正式开放其自动驾驶 AI 模型 Alpamayo 2 Super 的商业化使用。该模型旨在通过深度融合环境感知、逻辑推理与驾驶决策,专门攻克复杂的交通路况。其主要目标用户涵盖自动驾驶开发者、汽车制造商以及零部件供应商。

专为长尾场景打造的 VLA 模型
作为 Alpamayo 家族的一员,这款拥有 340 亿参数的前沿开放模型专为无人驾驶出租车(Robotaxi)及自动驾驶汽车研发。其核心优势在于应对超越常规驾驶场景的极端挑战,即那些罕见且难以预判的“长尾场景”。
英伟达指出,面对此类复杂情况,传统的物体检测和运动预测功能已捉襟见肘。自动驾驶汽车必须能够真正理解周围环境,分析因果关系,选择恰当的操作,并实时规划出安全、舒适的行驶路径。Alpamayo 2 Super 致力于在单一基础模型中整合上述能力,并使所有决策过程对开发者完全透明、可追溯。
与通常将感知、规划和控制拆分给多个专用模型的传统自动驾驶系统不同,Alpamayo 2 Super 采用了“视觉-语言-动作”(VLA)架构,在统一的框架内实现多任务协同。该模型能够引导车辆完成“感知场景、逻辑推理、规划决策、执行动作”的完整闭环。
强化复杂路况的推理能力
在处理信息时,该模型会综合车辆 360 度环视摄像头的画面,融合前、侧、后方的多重视角,从而对变道、并线、无保护左转及复杂十字路口等高危场景进行更精细的分析。
作为一款多任务模型,Alpamayo 2 Super 针对同一驾驶场景会输出多项紧密关联的结果:首先是车辆的规划行驶轨迹;其次是一条“因果链追踪”,用于清晰解释该操作背后的决策逻辑。
该模型基于英伟达 Cosmos 3 Super Reasoner 构建,并通过强化学习进行了深度优化。在强化学习过程中,软件智能体通过“试错”机制不断获得正向反馈,从而自主进化出最优驾驶策略。英伟达认为,该模型的两大核心突破在于:开放的商业授权,以及为自动驾驶开发提供的强大多任务处理能力。
基于 OpenMDW-1.1 协议的商用授权
相较于早期版本,Alpamayo 2 Super 最大的新规是全面开放商用。该模型已在 Hugging Face 平台上线,并采用 Linux 基金会推出的宽松许可协议 OpenMDW-1.1。该协议允许用户进行模型微调、开发衍生模型以及商业再分发。
https://huggingface.co/nvidia/Alpamayo2-Super英伟达希望借此赋能整个汽车产业链。企业可以将该模型与自有数据、驾驶策略及开发流程深度结合,同时保留对自身数据和基础设施的绝对控制权。目前,梅赛德斯-奔驰已在最新款 CLA 车型的 L2++ 级 MB. Drive Assist Pro 系统中采用了 Alpamayo 系列模型。
此外,这一全新许可协议也追溯适用于 Alpamayo 家族的历史版本。过去的模型主要面向研发测试,而现在,整个模型系列均可在无需额外审批的情况下直接投入商业部署。
性能领跑,力压近 40 款竞品
据英伟达披露,Alpamayo 2 Super 在多项自动驾驶能力评估测试中均斩获顶尖成绩。在衡量 AI 驾驶场景理解能力的 LingoQA 基准测试中,该模型在近 40 款参评产品中拔得头筹。在英伟达的内部测试中,其表现更是超越了 Qwen2.5-VL 72B、Gemini 2.5 Pro 以及 GPT-4o 等知名大模型。
与初代 Alpamayo 1 及 1.5 版本相比,Alpamayo 2 Super 的参数规模扩大了整整三倍。英伟达表示,这种额外的模型容量使其在处理罕见、复杂的交通状况时,能够从更少的样本中提炼出更精准的推理结论。
https://blogs.nvidia.com/blog/alpamayo-2-super-open-model-now-available/