2 citations · 6 across the 12 of their papers we have counts for
1 paper · 2 filters
Ruiqi Wu, Yuang Yao, Tengfei Ma +11
Multimodal large language models (MLLMs) have recently demonstrated remarkable reasoning abilities under reinforcement learning (RL) paradigm. However, most existing multimodal med…