小鹏第二代VLA大模型重大升级:AI进入4D时空理解,实现“记住过去、预判未来”

来源:财经网作者:闫祺2026-08-27 23:19
导语

依托百万车队数据资产,模型单次训练数据吞吐量较半年前增长10倍。这套基础设施也将支撑技术向飞行汽车等更多智能硬件拓展。

8月27日,小鹏集团在广州举办以“TIME 时间”为主题的物理AI分享暨第二代VLA全新版本体验日活动,宣布第二代VLA大模型迎来首次重大升级。全新XOS 6.3.0版本将在小鹏G9L车型上全球首发。此次升级的核心在于让AI开始真正理解时间,从对物理世界的静态3D空间理解跃迁至动态4D时空理解。

微信图片_20260827231436_2227_220

在技术层面,新版模型端侧参数量扩大3.5倍,达到主流VLA模型的15倍以上。模型引入Infini-VLA长时序架构,能够记忆前30秒的道路场景信息,改变了过去将道路事件视为独立画面的处理方式,实现了对连续事件的时序串联理解。与此同时,Streaming Inference流式自回归推理技术应用,将端到端响应速度提升300%,从传统“看-算-输出-再看”的离散模式转变为“边看、边想、边行动”的并行处理。

在预判能力方面,X-Foresight预测世界模型首次上车,能够根据目标物位置、速度及运动趋势,推演周边交通参与者未来6秒内的行为。结合模型规模的扩大和响应速度的提升,多维综合安全能力提升20倍。此外,新版本还采用MoT混合架构,针对城区道路、园区、泊车等不同任务动态分配模型能力,减少场景间的任务干扰。

微信图片_20260827231510_2229_220

小鹏同步推出Master Agent整车大脑,基于自研Omni全模态模型,实现了VLA与VLM的驾舱融合。该系统能够解析自然语言和模糊语义,自动拆解用户意图,并调度智驾、底盘、座舱等多个垂直Agent协同执行,从“听懂指令”迈向“理解意图”。基于该能力,量产车新增了“语音靠边停车”和“语音控制就近泊入”功能,将部分Robotaxi的L4级体验下放到量产车型。

技术底座层面,第二代VLA已实现L2至L4能力贯通。搭载该模型的Robotaxi已获得广州市主驾无安全员远程测试资质。同时,这一物理AI基座模型向人形机器人IRON完成端侧落地,该机器人搭载3颗图灵AI芯片,算力达2250TOPS,可脱离远程遥操作自主完成复杂任务。

小鹏机器人业务于8月24日完成首轮股权融资,融资金额超9亿美元,投后估值超63亿美元,刷新了中国具身智能行业单轮私募股权融资纪录。资金将主要用于机器人软硬件研发、模型训练及量产基地建设。小鹏IRON计划于2026年底进入量产阶段,2027年面向市场交付。

微信图片_20260827231444_2228_220

为覆盖更多车型,小鹏通过Token压缩与蒸馏训练推出图灵VLA 2.0 Lite版本,预计9月开启首批推送,G9L Max版本将首发搭载。全球化部署方面,第二代VLA已在德国完成本地化验收测试,在几乎不增加本地化训练数据的情况下,实际体验与中国高度接近。小鹏计划于2027年上半年在欧洲获得监管许可并向海外用户交付。

小鹏方面表示,模型能力持续进化的背后是完整的AI基础设施支撑。依托百万车队数据资产,模型单次训练数据吞吐量较半年前增长10倍。这套基础设施也将支撑技术向飞行汽车等更多智能硬件拓展。

(免责声明:此文内容为本网站刊发或转载企业宣传资讯,仅代表作者个人观点,与本网无关。仅供读者参考,并请自行核实相关内容。)

编辑:靖程

相关新闻

新闻爆料

010-85657581
  • 热门排行
  • 大家喜欢