1 paper
Hao Qiu, Junyan Wang, Zheyuan Liu +4
Manga visual question answering requires models to answer questions over panel-based visual narratives, where relevant evidence is distributed across ordered panels, embedded text,…