1 paper
Haojie Feng, Peizhi Zhang, Xinrui Zhang +7
Vision-language-action (VLA) models for autonomous driving jointly produce scene interpretation, language-based reasoning, and driving trajectories. Existing evaluations often use…