8月27日,小鹏集团在广州举办以”TIME 时间”为主题的物理AI分享暨第二代VLA全新版本体验日活动。小鹏第二代VLA大模型迎来首次重大升级,全新XOS 6.3.0版本将于小鹏G9L全球首发。此次升级的核心突破,是让AI开始真正理解”时间”维度。
从静态3D到动态4D的跨越
据小鹏介绍,传统的自动驾驶AI模型主要基于对物理世界的静态3D空间理解,即识别”物体在哪里、是什么”。而第二代VLA大模型的升级,实现了从静态3D空间理解向动态4D时空理解的跨越——AI不仅能感知当前时刻的空间状态,还能理解物体随时间变化的运动轨迹和行为意图。
这一能力的提升,意味着智能驾驶系统能够更准确地预测其他交通参与者的未来行为,从而做出更安全、更平顺的驾驶决策。例如,系统可以预判一辆停在路边的车辆是否即将开门、一个行人是否即将横穿马路,这些都需要对”时间”维度的深刻理解。
VLA架构的演进
VLA(Vision-Language-Action)架构是当前具身智能和自动驾驶领域的前沿技术路线。小鹏自第一代VLA大模型发布以来,持续在视觉感知、语言理解和动作决策三个维度进行优化。此次升级重点强化了时序建模能力,使模型能够处理更长的历史序列信息,并基于时间上下文做出更精准的决策。
全新XOS 6.3.0版本将首先搭载于小鹏G9L车型,后续将逐步推送至其他支持高阶智能驾驶的车型。用户可以通过OTA升级获得最新的智驾体验。
具身智能的”GPT时刻”?
业内观察人士认为,小鹏VLA大模型的此次升级,可能预示着具身智能领域正在接近”GPT时刻”。随着大模型技术在机器人和自动驾驶领域的深度应用,AI系统正在从”感知智能”向”认知智能”和”决策智能”演进。
近期,具身智能领域热点不断。世界人形机器人运动会设置了”智慧充电服务岗”等真实场景赛项,检验机器人在实际环境中的应用能力。一个粗糙的机器人操作视频更是在行业内引发广泛讨论,被认为可能预示着具身智能技术拐点的到来。
对于小鹏而言,VLA大模型的持续迭代不仅是智能驾驶能力的提升,更是其在物理AI领域布局的重要组成部分。随着AI从数字世界走向物理世界,自动驾驶和人形机器人有望共享底层技术栈,产生协同效应。风腾网将持续关注物理AI和具身智能领域的最新进展。
风腾网 - 最新 AI 风向|AI 工具、大模型与人工智能行业资讯




