1 paper
Mingyu Jeon, Sungjin Han, Jinkwon Hwang +3
Recent advances in Multimodal Large Language Models (MLLMs) have improved image recognition and reasoning, but video-related tasks remain challenging due to memory constraints from…