1 paper
Yuechen Luo, Qimao Chen, Fang Li +5
Vision-Language-Action (VLA) models for autonomous driving often hit a performance plateau during Reinforcement Learning (RL) optimization. This stagnation arises from exploration…