Showing cs.CVShow all
3 papers · 1 filter
cs.CV2026
ESC: Emotional Self-Correction for Reliable Vision-Language Models
Tien-Huy Nguyen, Minh-Nhat Nguyen, Nguyen Nhat Huy +9
Vision-language models (VLMs) have achieved strong performance across diverse multimodal tasks, yet they remain vulnerable to unreliable reasoning. Existing self-correction methods…
cs.CV2026
Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space
Quoc-Huy Trinh, Xi Ding, Yang Liu +7
Visual spatial intelligence is critical for medical image interpretation, yet remains largely unexplored in Multimodal Large Language Models (MLLMs) for 3D imaging. This gap persis…
cs.CV2026
Handling Supervision Scarcity in Chest X-ray Classification: Long-Tailed and Zero-Shot Learning
Ha-Hieu Pham, Hai-Dang Nguyen, Thanh-Huy Nguyen +4
Chest X-Ray (CXR) classification in clinical practice is often limited by imperfect supervision, arising from (i) extreme long-tailed multi-label disease distributions and (ii) mis…