1 paper · 1 filter
Taeyun Roh, Suhyeong Park, Dongyoung Lee +4
Multimodal multiple-choice question answering (MCQA) provides a standardized and objectively measurable setting for evaluating vision-language models (VLMs). However, because the M…