1 paper · 1 filter
Tianle Li, Jihai Zhang, Yongming Rao +1
While large language models (LLMs) demonstrate strong reasoning capabilities utilizing reinforcement learning (RL) with verifiable reward, whether large vision-language models (VLM…