1 paper · 1 filter
Kaito Tanaka, Yuji Nishimura, Keisuke Matsuda +1
Large vision-language models exhibit strong in-context learning (ICL) capabilities, yet when and why visual context helps multimodal ICL remains poorly understood. Empirical studie…