1 paper
Huiyuan Zheng, Houtao Zhang, Boyang Wang +2
Current evaluations for Multimodal Large Language Models (MLLMs) overwhelmingly focus on utility-driven objectives, leaving model behavior under logic-neutral scenarios largely und…