英伟达发布34B参数自动驾驶开源模型Alpamayo2Super
英伟达发布34B参数自动驾驶开源模型Alpamayo2Super
英伟达近日发布34B参数自动驾驶开源模型Alpamayo2Super,属于视觉语言动作(VLA)模型,基于Cosmos世界基础模型构建,3D视觉定位得分大幅领先闭源模型,面向L4级robotaxi开发。
英伟达近日正式发布自动驾驶开源模型Alpamayo2Super,为自动驾驶领域带来重要的开源贡献。
模型架构
Alpamayo2Super是一款视觉语言动作(VLA)模型,总参数量约34B:
- 32B参数 Cosmos3SuperReasoner视觉语言骨干网络
- 2.3B参数 动作专家模块
- 基于NVIDIA Cosmos世界基础模型构建,规模是前代Alpamayo的3倍
训练与开源
- 使用超过1727小时的驾驶数据进行训练
- 基于OpenMDW-1.1开放权重发布
- 配套开源AlpaSim评估框架
- 允许开发者和企业进行模型检查、微调和部署
性能与应用
- 3D视觉定位IoU得分达到71.0,大幅高于闭源模型的17.0分
- 面向L4级robotaxi开发,覆盖感知、推理、规划到行动的完整技术栈
- 支持多种自动驾驶场景:机器人出租车、卡车、穿梭车及配送车
这一开源模型将有力推动自动驾驶技术的普及和发展,降低行业研发门槛。