1 citations · 1 across the 2 of their papers we have counts for
1 paper · 1 filter
Ruiqi Wu, Yuang Yao, Tengfei Ma +6
Multimodal large language models (MLLMs) have recently demonstrated remarkable reasoning abilities under reinforcement learning (RL) paradigm. However, most existing multimodal med…