1 paper
Jiahang Cao, Hanye Zhao, Hang Lai +10
Advantage-guided reinforcement learning provides a practical way to post-train vision-language-action (VLA) policies using limited robot data. However, its performance depends on s…