1 paper
Tian Zhang, Zhuo Huang, Hongrui Ye +3
Vision-language-action (VLA) driving methods increasingly combine multi-trajectory imitation learning with group-relative policy optimization (GRPO), making trajectory selection cr…