1 paper · 1 filter
Xusen Hei, Jiali Chen, Jinyu Yang +2
As multimodal large language models (MLLMs) frequently exhibit errors in complex video reasoning scenarios, correcting these errors is critical for uncovering their weaknesses and…