1 paper · 1 filter
Shaopeng Zhai, Qi Zhang, Tianyi Zhang +5
When adapting Vision Language Action (VLA) models to downstream tasks, multiple rounds of post-training are often required to progressively address policy weaknesses. In this repor…