1 paper
Deepak Sridhar, Kartikeya Bhardwaj, Jeya Pradha Jeyaraj +3
Video reasoning using Large Multimodal Models (LMMs) relies on costly reinforcement learning (RL) and verbose chain-of-thought, resulting in substantial computational overhead duri…