论文精读|VLA for Autonomous Driving:自动驾驶视觉-语言-动作模型的过去、现在与未来

这份 47 页的综述首次为自动驾驶 VLA 建立了系统形式化与分类法,从 VA(视觉-动作)到 VLA(视觉-语言-动作)理清演进线。它提出端到端 VLA 与双系统 VLA 两大范式分类,并统一梳理了动作空间四分法、数据集基准与评测协议。是当前自动驾驶 VLA 领域最权威的架构脉络地图和未来挑战指南。

2026年7月19日 · 6 分钟 · 1207 字 ·