1 paper
Shimin Wen, Zeyu Zhang, Xingdou Bian +5
Large Vision-Language Models (VLMs) have demonstrated significant potential on complex visual understanding tasks through iterative optimization methods.However, these models gener…