版权声明:本文版权为网易汽车所有,转载请注明出处。
网易汽车9月1日报道 前不久,小鹏搞了一场以“TIME 时间”为主题的分享会,核心就一件事——第二代VLA大模型迎来首次重大升级。听上去像是一次常规的OTA,但听完分享会以及仔细看过技术细节之后,可以确定这次升级的意义,可能比很多人想象的要大。这次升级也是小鹏第二代 VLA大模型迎来发布之后的首次重大底层升级,将 AI 智驾从传统 3D 空间感知,推进至能够记忆历史、理解当下、预判未来的4D时空理解新阶段。全新XOS 6.3.0 车机系统由小鹏 G9L 全球首发,同时第二代 VLA 完整版与蒸馏 VLA 2.0 Lite 版本明确落地推送节奏,让高阶物理 AI 智驾能力实现更大范围的车型覆盖,践行科技普惠。
![]()
从“看一帧做决策”到“记住前30秒,预判后6秒”
我们都知道,在过去的几年,智驾行业的竞争逻辑基本是:感知准不准、决策快不快、功能多不多。本质上是AI在“看见当下”这件事上越做越好。而小鹏第二代VLA本次升级的核心突破,是把时间维度纳入物理世界基座模型,让AI不再孤立看待单帧路况画面,而是把道路当成连续动态演进的过程去理解。也就是说,它这次是让AI开始理解时间。
![]()
听起来有点玄,拆开看就很实在:
Infini-VLA长时序架构:模型现在可以记住前30秒的世界。这意味着什么?以前AI看路是一帧一帧的,前车变道、行人横穿、道路施工,每个事件都是独立的。现在它能串起来了——“30秒前那个路口有人在等,现在我接近一个类似的路口,大概率还会有人”。
X-Foresight预测世界模型:能预判未来6秒内会发生什么。前车可能要急刹、行人可能折返、旁车可能加塞——AI开始“预演未来”,而不是“被动反应”。
Streaming Inference流式推理:从“看→算→输出→再看”变成“边看边想边行动”,端到端响应速度提升300%。
这三个技术点合在一起,意味着什么?
智驾的决策逻辑,从“看到再反应”变成了“预测后行动”。
过去我们说“这个智驾像个新手”,是因为它的决策是割裂的、被动的、基于当下的。现在小鹏的AI开始有了“记忆”和“预判”,这在体验上的变化,可能比参数表上写的任何东西都更直接。
![]()
![]()
这次升级还有一个容易被忽略的点:Master Agent整车大脑。
过去我们把车机、智驾、底盘控制看成几个独立的模块。你说"我有点冷",车机调空调;你开智驾,智驾管开车。它们是割裂的。
现在小鹏的Master Agent,基于自研Omni全模态模型,把VLA和VLM打通了。你说"帮我找个地方停车",它不是简单理解为"导航去停车场",而是真的理解你的意图——调度智驾去找位置、控制底盘去靠边、执行泊入。
语音靠边停车、语音控制就近泊入——这两个功能听上去不复杂,但背后是"从听懂一句话,到理解你想完成什么"的跨越。
更狠的是,小鹏把Robotaxi的L4级能力,通过同源技术下放到了量产车上。你开的G9L,和将来跑无人Robotaxi的那套系统,底层是同一套东西。
![]()
![]()
G9L全球首发 完整版与 Lite 蒸馏版双线推送
结合硬件落地层面,官方也提到:小鹏G9L成为第二代VLA重大升级的首发车型,XOS 6.3.0 版本在G9L上全球首发。G9L Ultra/Ultra SE 版本搭载完整第二代VLA,充分释放图灵 AI 芯片算力,完整拥有 30 秒长时序记忆、6 秒轨迹预判、Master Agent 驾舱融合全套能力。
![]()
而为实现高阶智驾能力下沉普惠,小鹏推出图灵VLA 2.0 Lite蒸馏版本,通过学习式 Token 压缩与蒸馏训练,在不牺牲输入信息、模型容量的前提下,以更少有效 Token 完成高质量视觉理解,把第二代 VLA基座模型能力迁移到算力更低的单图灵Max硬件平台,G9L Max 版本将首发搭载 VLA 2.0 Lite,两个版本均预计9月开启首批 OTA 推送。
对于用户实际用车体验,不管是完整版还是蒸馏 Lite 版本,都将带来城区辅助驾驶的体验换代:复杂路口判断更加果断迟疑减少;变道、绕行、速度调节行驶轨迹更加连贯自然;整体智驾运行稳定性、驾乘安心感和通行效率同步提升。物理 AI 模型蒸馏难度远高于通用大模型,小鹏跑通高阶基座模型向下蒸馏落地路径,意味着先进智驾能力不再只局限于顶配车型,能够覆盖更多量产车型与用户群体,兑现科技普惠的产品理念。
在德国跑了一圈,证明模型能“出海”
另外,小鹏最近在德国慕尼黑完成了第二代VLA的本地化验收测试,其中最关键的是,几乎没加本地化训练数据,但体验与国内高度接近。这意味着这套模型不是在“中国数据”上过拟合的,它真的有泛化能力。欧洲的路口、路权规则、驾驶习惯和中国完全不同,能用同一套基座模型跑通,才是真正有说服力的全球化。小鹏目标是2027年上半年在欧洲拿到监管许可,开始向海外用户交付第二代VLA。如果这件事成了,小鹏会是第一个把"中国训练的智驾模型"带到欧洲主流市场的车企。
物理AI的长期主义:护城河不在模型,在生产模型的能力
何小鹏一直说小鹏是“物理AI公司”,不是“造车公司”也不是“自动驾驶公司”。听上去像在讲故事,但看完整场分享,这种感觉确实不一样了。
第二代VLA的底层模型,不只服务汽车——同样的技术底座,已经部署到小鹏的人形机器人IRON上(3颗图灵芯片,2250 TOPS算力),最近小鹏机器人还完成了超9亿美元的首轮融资,估值63亿美元,刷新中国具身智能行业纪录。
![]()
从汽车到机器人再到飞行汽车,小鹏想做的是“一套AI底座打通所有本体”。这个逻辑,和特斯拉从车到Optimus的路径是一模一样的。区别在于,特斯拉有FSD的规模优势,而小鹏的优势是——它可能是中国唯一在"物理AI基座模型+端侧部署+多本体复用"这条路上走通的公司。至于这条路能走多远,取决于AI Infra的长期投入——数据飞轮、算力储备、工具链建设,这些看不见的东西,才是真正的护城河。
![]()
结语
小鹏这次用“时间”这个关键词,把智驾的竞争从“感知当下”拉到了“理解过去、预判未来”的维度。能不能真的跑通,还要看后续的实际体验和全球化验证。但至少现在,小鹏已经不在“中国智驾第一梯队”这个语境里了,它在和特斯拉、英伟达讨论同一个问题:AI怎么理解物理世界,这个起点,已经不一样了。
