1 paper
Zeliang Zhang, Zhuo Liu, Mingqian Feng +1
CLIP has demonstrated great versatility in adapting to various downstream tasks, such as image editing and generation, visual question answering, and video understanding. However,…