1 paper
Aybora Koksal, A. Aydin Alatan
Remarkable capabilities in understanding and generating text-image content have been demonstrated by recent advancements in multimodal large language models (MLLMs). However, their…