1 paper
Baixuan Xu, Yinyui Xu, Tianshi Zheng +9
While LVLMs rapidly improve, long-video question answering still remains challenging: relevant evidence is sparse, and question-relevant context often fails to provide cues that di…