1 paper
Guo Yutong, Wanying Wang, Yue Wu +2
Table Visual Question Answering (Table VQA) is typically addressed by large vision-language models (VLMs). While such models can answer directly from images, they often miss fine-g…