1 paper · 1 filter
Qinsi Wang, Bo Liu, Tianyi Zhou +6
Although reinforcement learning (RL) has emerged as a promising approach for improving vision-language models (VLMs) and multimodal large language models (MLLMs), current methods r…