1 paper · 1 filter
Hyesu Lim, Jinho Choi, Taekyung Kim +3
High-performing vision language models still produce incorrect answers, yet their failure modes are often difficult to explain. To make model internals more accessible and enable s…