分类导航

取消

热门标签

Pull down to refresh...
Pull down to refresh...
上拉加载更多
小鹏第二代VLA升级,让智能拥有时间感知能力
2026-08-27 22:40 1119次阅读

感光驾客

愿每一台汽车,都能在生活中给予你陪伴。 愿每一项科技,都能体现出它最大的价值。 愿每一部相机,都能记录当下发生的美好。

2026年8月27日,小鹏在广州举办主题为“TIME时间”的物理AI分享活动,正式对外发布第二代VLA大模型的重要迭代版本,配套的XOS 6.3.0系统将在小鹏G9L车型上实现全球首发。本次升级最核心的突破,是把时间维度纳入模型的认知框架,让智能系统从传统静态3D空间理解,升级为4D时空动态感知,为自动驾驶的安全性与实用性带来实质性提升。

以往的车载AI模型,大多只能处理当下采集到的画面信息,可以识别道路上的车辆、行人、信号灯,但缺少对事件前后因果、连续变化过程的理解,无法完整还原道路场景的动态演变。第二代VLA大模型搭建Infini‑VLA长时序架构,能够留存近30秒内的道路场景信息,不再把连续的行车画面切割成独立片段,而是串联起过往车辆动作、位置变化,形成完整的场景记忆。同时模型引入流式自回归推理模式,改变过去“采集 - 运算 - 输出”的循环工作逻辑,做到边感知、边运算、边响应,端到端响应速度相比之前提升300%,面对前车急刹、行人突然折返、其他车辆强行加塞等突发路况,可以做出更贴合人类老司机的快速处置。

除了回望已经发生的路况,这套模型还搭载X‑Foresight预测世界模型,能够预判未来6秒周边交通参与者的行为趋势。系统综合目标物体的位置、行驶速度、运动走向以及道路环境等多重信息,推演多种可能性,提前为车辆决策提供参考。借助MoT混合架构,模型可以针对城区通行、园区行驶、自动泊车等不同任务分配运算资源,降低不同场景之间的相互干扰,保障各项驾驶任务平稳切换。升级后端侧模型参数量扩3.5倍,达到主流同类VLA模型的15倍以上,多维综合安全能力实现20倍的提升。

本次更新不局限于智驾模块,小鹏推出Master Agent整车大脑,完成VLA视觉语言模型与VLM大模型的驾舱融合。该组件基于自研Omni全模态模型开发,不再局限于简单执行语音指令,而是解读用户的真实意图,把复杂需求拆解成多项细分任务,调度智驾、底盘、车身、座舱各个单元协同完成操作。依托这套能力,量产车落地“语音靠边停车”“语音就近泊入”功能,用户发出语音指令,车辆便可自主寻找合适位置完成停车。小鹏还将Robotaxi的部分L4 级自动驾驶能力下放至量产车型,让普通用户体验到更高阶的智能出行效果。

为了让更多车主享受升级红利,小鹏通过模型蒸馏技术推出 VLA 2.0 Lite 轻量化版本,适配算力相对有限的车载硬件,预计 9 月开启推送。海外布局方面,第二代 VLA 模型已经完成德国本地化道路测试,国内训练的模型在海外道路同样保持稳定表现,小鹏计划争取在明年上半年拿到欧洲相关监管许可,推进高阶智驾能力出海落地。

小鹏认为物理 AI 的核心壁垒不只是模型参数,更是完整的 AI 基础设施。依托海量车队积累的十亿级真实道路数据,搭建起包含数据存储、检索挖掘、训练仿真、迭代优化的闭环体系,依靠数据飞轮持续驱动模型迭代,实现汽车、机器人等不同智能硬件之间的能力复用,推动物理 AI 技术持续落地发展。

# 新车前瞻 # 小鹏 # LITE # 小鹏G9

相关车系

推荐

评论