小鹏第二代VLA大模型迎来升级:从3D空间理解走向4D时空理解

小鹏第二代VLA大模型迎来升级:从3D空间理解走向4D时空理解

凤凰网评测讯(作者/张昊)2026年8月27日,小鹏集团在广州举办以“TIME 时间”为主题的物理AI分享暨第二代VLA全新版本体验日活动。小鹏第二代VLA大模型迎来首次重大升级,全新XOS 6.3.0版本将由小鹏G9L全球首发。此次升级的核心,是将模型对物理世界的理解从3D空间扩展到4D时空,让系统具备更长时序记忆、连续推理和未来行为预测能力。

从技术方向看,小鹏此次升级重点不只是提升识别能力,而是让模型把道路变化理解为一个连续过程。真实交通环境并非静态画面,车辆、行人、非机动车和道路条件都在持续变化。只有同时理解过去、现在和未来,智能驾驶辅助系统才有可能在复杂场景中做出更稳定的判断。

第二代VLA全新版本引入Infini-VLA长时序架构,可记住前30秒内的道路环境变化。连续发生的交通事件不再被切分为孤立画面,模型能够把此前的目标位置、动作趋势和道路关系串联起来,形成更完整的上下文理解。这对于前车急刹、行人折返、旁车加塞等场景,具有更直接的意义。

在推理效率方面,新版本采用Streaming Inference流式自回归推理,从离散推理转向连续推理。官方称,端到端响应速度提升300%。这意味着系统可以在持续接收道路信息的同时进行推理和决策,减少“看见—计算—输出—再看”的割裂感,提升对动态路况的响应能力。

预测能力方面,小鹏X-Foresight预测世界模型首次上车,可对未来6秒内可能发生的交通变化进行推演。系统会结合目标物的位置、速度、运动趋势和道路环境,判断周边交通参与者的可能行为。对于智能驾驶辅助而言,预测并不等同于确定未来,而是在多种可能路径中提前评估风险并选择更稳妥的动作。

模型架构方面,新版本还引入MoT混合架构,根据不同任务动态分配模型能力,减少城区道路、园区、泊车等不同场景之间的任务干扰。官方称,第二代VLA全新版本端侧模型参数量提升3.5倍,是主流VLA的15倍以上;结合长时序、预测和响应能力提升,多维综合安全能力提升20倍。相关数据均为官方公布口径,实际体验仍需以量产版本和道路环境为准。

此次升级也延伸到座舱和整车控制。小鹏首次推出Master Agent,实现VLA与VLM的驾舱融合。该系统基于小鹏自研Omni全模态模型,可理解自然语言和模糊意图,并将用户需求拆解为任务,调度智能驾驶辅助、底盘、座舱和车身控制等垂直Agent协同执行。

在功能层面,全新版本带来“语音靠边停车”“语音控制就近泊入”等能力。用户发出语音指令后,车辆可在智能驾驶辅助状态下寻找合适位置并完成相应泊车动作。需要说明的是,这类能力仍属于辅助驾驶和车辆控制功能,使用范围、开放道路、功能边界和安全责任,应以法规要求、交付版本及官方说明为准。

除量产车外,小鹏也在推动同一技术底座向Robotaxi和机器人等更多本体复用。搭载第二代VLA的Robotaxi近日获得广州市智能网联汽车远程测试资质,可在广州相关测试道路开展主驾无安全员道路测试。与此同时,小鹏通用人形机器人IRON搭载3颗图灵AI芯片,有效算力达到2250TOPS,物理世界基座模型已实现端侧部署。

资本层面,小鹏机器人业务于8月24日完成首轮股权融资,融资额超过9亿美元,投后估值超过63亿美元。本轮融资由IDG资本领投,高榕创投参投,并获得腾讯、阿里巴巴两家战略投资者支持。对于小鹏而言,汽车、Robotaxi与机器人共用技术底座,是其讲述物理AI长期价值的核心逻辑。

落地节奏方面,图灵VLA 2.0 Lite预计9月开启首批推送,小鹏G9L Max版本将首发搭载这一蒸馏版本;全新XOS 6.3.0则将由小鹏G9L全球首发。此次活动重点为技术升级和版本体验,小鹏暂未公布G9L具体售价信息,后续车型价格、配置和交付安排仍需以官方上市信息为准。