点击右上角
微信好友
朋友圈

请使用浏览器分享功能进行分享

8月27日,小鹏集团举办以“TIME 时间”为主题的物理AI分享暨第二代VLA全新版本体验日活动,其自研的第二代VLA大模型迎来重大升级,搭载全新模型能力的XOS 6.3.0系统,将于小鹏G9L车型上全球首发。本次升级让AI突破静态空间理解边界,正式建立起对“时间”维度的认知能力,标志着国内智能驾驶领域的基座模型实现从3D空间到4D时空的底层跃迁。
不同于传统智驾模型仅能识别当下瞬间的道路信息,小鹏第二代VLA大模型本次升级的核心突破,是将“时间变量”纳入物理世界理解体系,真正实现“记住过去、理解现在、预判未来”的全链路时序认知。模型全新引入Infini-VLA长时序架构,可完整记录前30秒内的道路动态变化,不再把连续发生的车辆变道、行人移动等交通事件割裂为独立画面,而是将此前的动作、位置和场景信息串联为连贯完整的驾驶上下文。同时模型采用流式自回归推理机制,端到端响应速度直接提升300%,打破传统智驾模型“看、算、输出”的离散处理模式,实现“边看、边想、边行动”的并行运算,面对前车突然刹停、旁车强行加塞等突发场景时,能够做出类似人类老司机的敏捷反应。
配套搭载的X-Foresight预测世界模型,实现对周边交通参与者6秒内行为轨迹的提前预判,结合针对不同驾驶任务动态分配算力的MoT混合架构,可在城区道路、园区通行、自动泊车等多场景之间稳定切换,不会出现不同任务的能力干扰。升级后的端侧模型参数量扩大3.5倍,是当前行业主流VLA模型的15倍以上,多维综合安全能力整体提升20倍。
本次升级并非仅针对智能驾驶板块,小鹏选择以机器人研发逻辑重构整车大脑,推出Master Agent全域调度系统,实现VLA智驾模型与VLM座舱大模型的深度融合,让车辆不再是被动执行单一语音指令的工具,而是可以自主拆解用户模糊需求、调度智驾、底盘、车身等多个模块协同执行的统一“整车大脑”。
依托该能力,新系统落地了“语音靠边停车”“语音控制就近泊入”等全新功能,用户只需通过口语化指令提出停车需求,车辆就能在智驾开启状态下自主寻找合规的安全区域完成整套操作。此前已在Robotaxi验证的L4级同源技术,也通过新版本逐步下放到量产车型,让普通用户无需等待无人驾驶商业化落地,就能提前体验到高阶智能驾驶的便捷性。
依托这套统一的物理AI基座,小鹏的高阶智驾技术也正在向人形机器人等更多智能本体迁移复用。目前搭载第二代VLA相关能力的通用人形机器人IRON已实现端侧自主任务执行,8月刚刚完成的超9亿美元首轮融资,也创下国内具身智能行业单轮股权融资新纪录,资本市场的认可进一步印证了这条“车机同源”的物理AI落地路径的商业化潜力。
据了解,目前第二代VLA已经在德国完成本地化道路验收测试,在几乎不新增额外本地化训练数据的情况下,欧洲城市道路体验已和国内表现高度接近,相关版本预计明年上半年率先在欧洲落地交付,推动中国自研的高阶智驾能力实现全球化普惠。(赵艳艳)
