AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

小鹏第二代VLA大模型重大升级 4D时空能力重构智驾体验

8月27日小鹏举办“TIME时间”物理AI分享会,公布第二代VLA大模型发布以来的首次重大升级成果,核心实现从静态3D空间理解到动态4D时空理解的底层能力跃迁,端侧模型参数量扩大3.5倍,综合安全能力提升20倍,搭载该升级的XOS6.3.0系统将在小鹏G9L全球首发,同步将部分L4级Robotaxi体验下放至量产车型。

过去很长一段时间,自动驾驶大模型的能力都停留在对静态3D空间的感知层面,无法准确预判交通参与者的连续行为变化,这也是很多智驾系统在复杂城市工况下表现不稳定的核心痛点。小鹏此次针对VLA大模型的升级,直接瞄准了这一行业长期未解决的难题。

此次升级的核心突破,是让VLA大模型首次具备了对时间维度的理解能力,推动物理AI基座模型实现从静态3D空间理解到动态4D时空理解的底层跃迁。此前行业内的智驾大模型多是基于单帧或少量帧的图像进行环境感知,相当于只看“照片”判断路况,而具备4D时空理解能力的VLA大模型相当于看“连续视频”,能够更精准预判行人、非机动车等弱势交通参与者的行动轨迹。物理AI面对的真实世界并非一张张静止的图像,而是连续演进的动态系统,只有掌握了时间维度的变化规律,大模型才能像人类司机一样预判风险、做出更符合真实场景的决策。

作为业内最早在自动驾驶领域验证Scaling Law(缩放定律)的企业之一,小鹏此次将端侧模型的参数量直接扩大了3.5倍,和市面上常见的端侧小模型拉开了数量级差距。配合新增的超长时序上下文记忆能力,升级后的VLA大模型支撑下的智驾系统真正做到了“看得准、会思考、反应快”,经实测综合安全能力较此前版本提升20倍。此次升级也进一步验证了小鹏一直坚持的技术路线:在自动驾驶场景下,大模型的能力会随着参数量、训练数据量的提升持续增长,不存在过早的天花板。

此次升级的技术成果将率先落地到XOS6.3.0版本中,并在小鹏G9L车型上全球首发。新版本还首次引入了整车大脑Master Agent,实现VLA大模型与VLM多模态大模型的驾舱融合,打通了智驾和座舱的能力边界,智驾系统感知到的路况信息可以直接同步给座舱,为用户提供更自然的交互体验。值得关注的是,小鹏还将此前只有Robotaxi才能提供的部分L4级智驾体验下放到了量产车型,普通消费者无需等待Robotaxi规模化落地,就能体验到高阶智驾的能力。

此前大模型的竞争更多集中在通用大语言模型领域,而随着多模态、具身智能等技术的发展,能够理解和交互物理世界的物理AI正在成为新的竞争焦点。小鹏此次VLA大模型的升级,相当于为行业提供了物理AI落地智驾场景的可行路径,未来随着技术的进一步成熟,物理AI还将在机器人、工业自动化、智能家居等更多场景释放价值。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。