1 paper
Sayeed Shafayet Chowdhury, Md. Shaown Miah, S. M. Taiabul Haque +1
Vision-language models (VLMs) can produce confident visual answers even when the required visual evidence is missing, blank, or unrelated to the question. This failure mode, recent…