1 paper · 1 filter
Shimin Wen, Zeyu Zhang, Xingdou Bian +5
Large Vision-Language Models (VLMs) have demonstrated significant potential on complex visual understanding tasks through iterative optimization methods.However, these models gener…