1 paper
Sungkyung Kim, Adam Lee, Junyoung Park +3
Recent advancements in large language models have demonstrated enhanced capabilities in visual reasoning tasks by employing additional encoders for aligning different modalities. W…