collaborators

5 papers

cs.CV2025

Consistent Story Generation: Unlocking the Potential of Zigzag Sampling

Mingxiao Li, Mang Ning, Marie-Francine Moens

Text-to-image generation models have made significant progress in producing high-quality images from textual descriptions, yet they continue to struggle with maintaining subject co…

cs.CL2025

Mitigating Negative Interference in Multilingual Sequential Knowledge Editing through Null-Space Constraints

Wei Sun, Tingyu Qu, Mingxiao Li +2

Efficiently updating multilingual knowledge in large language models (LLMs), while preserving consistent factual representations across languages, remains a long-standing and unres…

cs.CV2025

Towards More Accurate Personalized Image Generation: Addressing Overfitting and Evaluation Bias

Mingxiao Li, Tingyu Qu, Tinne Tuytelaars +1

Personalized image generation via text prompts has great potential to improve daily life and professional work by facilitating the creation of customized visual content. The aim of…

cs.CV2025

Action-based image editing guided by human instructions

Maria Mihaela Trusca, Mingxiao Li, Marie-Francine Moens

Text-based image editing is typically approached as a static task that involves operations such as inserting, deleting, or modifying elements of an input image based on human instr…

cs.CV2024

TS-LLaVA: Constructing Visual Tokens through Thumbnail-and-Sampling for Training-Free Video Large Language Models

Tingyu Qu, Mingxiao Li, Tinne Tuytelaars +1

Recent advances in multimodal Large Language Models (LLMs) have shown great success in understanding multi-modal contents. For video understanding tasks, training-based video LLMs…