1 paper · 1 filter
Mohammadmostafa Rostamkhani, Baktash Ansari, Hoorieh Sabzevari +2
In recent years, Visual Question Answering (VQA) has made significant strides, particularly with the advent of multimodal models that integrate vision and language understanding. H…