1 paper
Musashi Hinck, Carolin Holtermann, Matthew Lyle Olson +6
We uncover a surprising multilingual bias occurring in a popular class of multimodal vision-language models (VLMs). Including an image in the query to a LLaVA-style VLM significant…