1 paper
Zixi Yang, Jiapeng Li, Muxi Diao +2
Recently, Multi-modal Large Language Models (MLLMs) have demonstrated significant performance across various video understanding tasks. However, their robustness, particularly when…