1 paper
Hao-Xuan Ma, Jin-Fei Qi, Yicheng Xiao +1
Multimodal large language models (MLLMs) have recently made strong progress in vision-language reasoning, yet their performance often degrades as generations grow longer. A key fac…