1 paper · 1 filter
Yiyang Lu, Woong Shin, Ahmad Maroof Karimi +3
Vision-Language Models (VLMs) frequently misread values, hallucinate details, and confuse overlapping elements in charts. Current approaches rely solely on pixel interpretation, cr…