1 paper · 1 filter
Tien-Huy Nguyen, Minh-Nhat Nguyen, Nguyen Nhat Huy +9
Vision-language models (VLMs) have achieved strong performance across diverse multimodal tasks, yet they remain vulnerable to unreliable reasoning. Existing self-correction methods…