
英伟达近日发布自动驾驶开源模型Alpamayo2Super。该模型拥有约34B参数,由32B参数的Cosmos3SuperReasoner视觉语言骨干和2.3B参数的动作专家组成,属于视觉语言动作(VLA)模型。Alpamayo2Super基于NVIDIACosmos世界基础模型构建,规模是前代Alpamayo1.5和Alpamayo1的3倍,并基于OpenMDW-1.1开放权重,允许开发者和企业进行模型检查、微调和部署。该模型使用超过1727小时的驾驶数据训练,配备开源的AlpaSim评估框架。在基准测试中,其3D视觉定位IoU得分为71.0,高于闭源模型的17.0分。Alpamayo2Super面向L4级robotaxi开发,覆盖感知、推理、规划到行动的完整自动驾驶技术栈,支持机器人出租车、卡车、穿梭车及配送车。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”