导读:小鹏第二代VLA此次升级的核心,是将“时间”纳入模型对物理世界的理解范围,使其从静态的3D空间理解进一步走向动态的4D时空理解。
【文/观察者网 周盛明 编辑/高莘】
8月27日,小鹏集团在广州举行以“TIME 时间”为主题的物理AI分享暨第二代VLA全新版本体验日活动,宣布第二代VLA大模型迎来首次重大升级,全新XOS 6.3.0版本将由小鹏G9L全球首发。
此次升级的核心,是将“时间”纳入模型对物理世界的理解范围,使其从静态的3D空间理解进一步走向动态的4D时空理解。换言之,模型不再只识别眼前的车辆、行人和道路信息,还能够关联此前发生的事件,并对接下来的道路变化作出预测。
小鹏第二代VLA全新版本 小鹏集团
具体来看,第二代VLA引入Infini-VLA长时序架构,可以记忆此前30秒的道路信息,将连续发生的动作、位置和场景串联起来,为驾驶决策提供更完整的上下文。
新版模型同时采用Streaming Inference流式自回归推理,从过去“看、计算、输出、再看”的离散模式,转向感知、推理和行动并行的连续模式,端到端响应速度提升300%。面对前车突然刹停、行人折返、旁车加塞等突发情况,车辆可以更快完成判断和响应。
在预测能力方面,小鹏X-Foresight预测世界模型首次上车,可根据交通参与者的位置、速度、运动趋势及道路环境,推演未来6秒内可能发生的情况。
新版模型还引入MoT混合架构,针对城区道路、园区和泊车等不同场景动态分配模型能力,减少不同任务之间的相互干扰。
小鹏第二代VLA全新版本的端侧模型参数量扩大至此前的3.5倍,达到主流VLA的15倍以上。结合更长的有效时序、更快的响应速度和轨迹预判能力,小鹏称,新版模型的多维综合安全能力提升20倍。
小鹏第二代VLA全新版本 小鹏集团
此次升级也从智能辅助驾驶延伸至智能座舱。小鹏首次推出整车大脑Master Agent,实现VLA与VLM的驾舱融合。该系统建立在小鹏自研Omni全模态模型之上,可以理解自然语言和模糊语义,将用户意图拆解为具体任务,并调度智驾、底盘、座舱和车身控制等垂直Agent协同执行。
基于这套能力,全新版本新增“语音靠边停车”和“语音控制就近泊入”等功能。用户发出指令后,车辆可在智驾状态下自主寻找合适位置,完成靠边停车或泊入车位。部分Robotaxi的L4级能力也将通过同源技术进入量产车型。
为覆盖不同算力平台,小鹏还通过Token压缩和蒸馏训练,将第二代VLA的部分能力部署至算力更低的平台。蒸馏后的图灵VLA 2.0 Lite预计于9月启动首批推送,小鹏G9L Max版本将首发搭载。
在更高阶自动驾驶方面,小鹏介绍,第二代VLA已经打通L2至L4技术底座。搭载该模型的小鹏Robotaxi近日获得广州市智能网联汽车远程测试资质,可在广州相关一、二、三级测试道路开展主驾无安全员道路测试,进入主驾无人的道路验证阶段。
小鹏第二代VLA全新版本 小鹏集团
同一套物理AI底座也在向机器人延伸。小鹏通用人形机器人IRON搭载3颗图灵AI芯片,有效算力达到2250 TOPS,物理世界基座模型已经实现端侧部署。
8月24日,小鹏机器人业务完成首轮股权融资,融资金额超过9亿美元,投后估值超过63亿美元。该轮融资由IDG资本领投、高榕创投参投,并获得腾讯、阿里巴巴两家战略投资者支持。
支撑模型持续升级的,是小鹏长期建设的AI Infra体系。目前,小鹏依托百万辆车队和十亿级数据资产,建立起覆盖数据采集、模型训练、仿真、评估、部署及用户反馈的完整闭环。其模型单次训练数据吞吐量已经达到1亿个clips,较半年前增长10倍。
小鹏第二代VLA全新版本 小鹏集团
小鹏也在推进第二代VLA的海外部署。小鹏官方称,该模型近期已在德国完成本地化验收测试,在几乎未增加本地训练数据的情况下,德国城市道路体验与国内接近。
按照规划,小鹏将在2027年上半年争取率先获得欧洲监管许可,并陆续向海外用户交付第二代VLA。
本文系观察者网独家稿件,未经授权,不得转载。