中国经济新闻网讯(刘晨曦)8月27日,小鹏集团举办以“TIME时间”为主题的物理AI分享暨第二代VLA全新版本体验日活动,宣布第二代VLA大模型迎来首次重大升级,全新XOS 6.3.0版本将于小鹏G9L全球首发并全系标配。此次升级的核心,是让AI从过去对物理世界的静态3D空间理解,跃迁至动态4D时空理解,真正开始理解“时间”。

传统模型只能识别当下的车辆、行人、道路和信号,但真实世界是连续变化的过程。第二代VLA全新引入Infini-VLA长时序架构,能够记住前30秒的世界,将此前发生的动作、位置和场景串联起来,形成完整时序理解,不再把连续道路事件割裂成独立画面。同时,模型采用Streaming Inference流式自回归推理,从离散推理走向连续推理,端到端响应速度提升300%,做到“边看、边想、边行动”。面对前车突然刹停、行人折返、旁车强行加塞等突发情况,车辆反应更加敏捷。X-Foresight预测世界模型也首次上车,可预判6秒内可能发生的情况,推演周边交通参与者的未来行为。新版模型还引入MoT混合架构,针对城区道路、园区、泊车等不同场景动态分配模型能力,减少任务干扰,让模型在不同驾驶任务间更稳定切换。
更大的模型带来更强泛化能力。第二代VLA全新版本端侧模型参数量扩大3.5倍,是主流VLA的15倍以上,结合轨迹预判、超长时序和更快决策响应,多维综合安全能力提升20倍。
此次升级不止于智能辅助驾驶。小鹏首次推出整车大脑Master Agent,基于自研Omni全模态模型,实现VLA与VLM的驾舱融合。Master Agent不仅能理解自然语言和模糊语义,还能将用户意图自动拆解为任务,调度智驾、底盘、座舱、车身控制等垂直Agent协同执行,让整车第一次拥有统一大脑,从“听懂一句话”走向“理解用户真正想完成什么”。全新版本还带来“语音靠边停车”“语音控制就近泊入”功能,用户只需语音下达停车指令,车辆即可在智驾状态下自主寻找合适位置完成停车,实现从“语音指令”到“自主执行”的闭环。小鹏Robotaxi的L4级能力正通过同源技术下放至量产车。

小鹏集团定位为“物理AI世界的出行探索者”。第二代VLA基于统一技术底座,已实现L2至L4能力贯通,搭载第二代VLA的Robotaxi近日获广州市智能网联汽车远程测试资质,可开展主驾无安全员道路测试。这一能力也向机器人等更多本体落地。小鹏通用人形机器人IRON搭载3颗图灵AI芯片,有效算力2250TOPS,可实现端侧部署,无需远程遥操作即可自主完成复杂任务。8月24日,小鹏机器人业务完成首轮股权融资,融资超9亿美元、投后估值超63亿美元,刷新国内具身智能行业单轮私募股权融资纪录,由IDG资本领投,高榕创投参投,腾讯、阿里巴巴为战略投资者。
小鹏还通过学习式Token压缩与蒸馏训练,将第二代VLA基座模型能力部署到算力更低平台,推出图灵VLA 2.0 Lite,预计9月开启首批推送,小鹏G9L Max版本首发搭载。全球化方面,小鹏近期在德国完成第二代VLA本地化验收测试,基于中国数据训练的模型在几乎不增加本地训练数据的情况下,德国城市道路体验与国内高度接近,目标明年上半年率先在欧洲获得监管许可并陆续交付海外用户。
物理AI是长期工程,护城河在于AI Infra的长期沉淀。小鹏持续建设覆盖数据、训练、仿真、评估、部署和算力的完整AI Infra体系,依托百万车队和十亿级数据资产构建数据飞轮,模型单次训练数据吞吐量达1亿clips,比半年前增长10倍。随着模型、数据、算力和本体的协同增长,小鹏正推动物理AI从汽车向机器人、飞行汽车等更多本体扩展,走向更广阔的物理世界。










预告

回放



