1 paper
Trang Nguyen, Naoaki Okazaki
Generalization in Visual Question Answering (VQA) requires models to answer questions about images with contexts beyond the training distribution. Existing attempts primarily refin…