1 paper · 1 filter
Jiahe Chen, Jiaying He, Qiyuan Chen +6
Large Vision-Language Models (LVLMs) face a tug-of-war between powerful linguistic priors and visual evidence, often leading to \emph{semantic drift}: a progressive detachment from…