1 paper
Daniel A. P. Oliveira, David Martins de Matos
Visual storytelling systems, particularly large vision-language models, struggle to maintain character and object identity across frames, often failing to recognize when entities i…