1 paper · 1 filter
Sungkyung Kim, Adam Lee, Junyoung Park +3
Recent advancements in large language models have demonstrated enhanced capabilities in visual reasoning tasks by employing additional encoders for aligning different modalities. W…