8月27日,小鹏集团举办以“TIME 时间”为主题的物理AI分享暨第二代VLA全新版本体验日活动。据介绍,小鹏第二代VLA大模型迎来重大升级,全新XOS 6.3.0版本将于小鹏G9L全球首发。

此次模型升级的核心,在于让AI真正开始理解时间:从过去对物理世界的静态3D空间理解,进一步迈向动态4D时空理解。简单来说,就是让模型“记住过去、理解现在、预判未来”,使车辆能够知晓过去、现在以及未来可能发生什么。

打开网易新闻 查看更多图片

据介绍,小鹏第二代VLA全新引入Infini-VLA长时序架构,使模型能够记住前30秒的世界,驾驶判断因此拥有了更长的上下文,更多有效信息得以进入模型。连续发生的道路事件不再被割裂成一个个独立画面,模型可以将此前发生的动作、位置和场景串联起来,形成更完整的时序理解。

第二代VLA还同步提升了模型推理效率,采用流式自回归推理,实现“边看、边想、边行动”的并行处理。例如,面对前车突然刹停、行人折返、旁车强行加塞等突发情况,车辆的反应如同经验丰富的老司机般娴熟敏捷。这一模型的参数量是主流VLA的15倍以上,能让多维综合安全能力提升20倍。

打开网易新闻 查看更多图片

同时上车的还有小鹏X-Foresight预测世界模型,该模型可预判6秒内可能发生什么,推演周边交通参与者未来的可能行为。新版模型还引入MoT混合架构,通过针对不同任务动态分配模型能力,减少城区道路、园区、泊车等不同场景之间的任务干扰,把不同的问题交给不同的“专家”,让模型在不同驾驶任务之间更加稳定地切换。

打开网易新闻 查看更多图片

活动当天,小鹏首次推出“统一大脑”Master Agent,让车辆从“听懂一句话”进一步走向“理解用户真正想完成什么”。据介绍,Master Agent建立在小鹏自研Omni全模态模型之上,除了能理解自然语言和模糊语义,还能将用户意图自动拆解为任务,并调度智驾、底盘、座舱、车身控制等垂直Agent协同执行,实现从“理解”到“行动”的闭环。

值得一提的是,本次全新版本升级还带来了“语音靠边停车”“语音控制就近泊入”功能,用户只需通过语音下达停车指令,车辆即可在智驾状态下自主寻找合适位置并完成靠边停车,给车主带来更高阶、更自然的用车体验。

据了解,搭载小鹏第二代VLA的Robotaxi近日获得广州市智能网联汽车远程测试资质,可在广州相关一、二、三级测试道路开展主驾无安全员道路测试,这意味着小鹏已进入主驾无人的关键道路验证阶段。

打开网易新闻 查看更多图片

除了汽车,这一能力也正在向机器人等更多本体落地。据介绍,小鹏机器人业务近期已完成首轮股权融资,目前小鹏通用人形机器人IRON搭载3颗图灵AI芯片,有效算力高达2250 TOPS。依托行业领先的算力基础,小鹏物理世界基座模型已实现端侧部署,无需远程遥操作即可自主完成复杂工作任务,同时保障推理低时延与数据安全。

在持续提升模型性能的同时,小鹏正全力推进第二代VLA的全球化部署。近期,小鹏在德国完成了第二代VLA的本地化验收测试,目标在明年上半年率先在欧洲获得监管许可,并陆续向海外用户交付第二代VLA,推动高阶智能辅助驾驶的全球普惠。

据介绍,小鹏依托百万车队和十亿级数据资产持续构建数据飞轮,通过统一化存储、多模态检索和规模化挖掘,将海量真实世界数据转化为可训练优化模型的数据资产。目前模型单次训练数据吞吐量已达1亿clips,较半年前增长10倍。通过对数据进行结构化、标签化和语义化处理,小鹏能够从海量真实数据中发现未知问题,并反哺模型训练与迭代形成正向循环,为用户带来全新的使用体验。