1 paper
Xuefei Sun, Doncey Albin, Cecilia Mauceri +2
Multimodal large language models (MLLMs) have demonstrated remarkable abilities in comprehending visual input alongside text input. Typically, these models are trained on extensive…