1 paper
Mao-Lin Luo, Zhe-Xu Wang, Zi-Hao Zhou +4
Continual post-training is becoming a central paradigm for adapting vision-language models to evolving tasks. Recent work has increasingly favored reinforcement learning over super…