1 paper
Yi Zhang, Lingxiao Wei, Bowei Zhang +3
Vision Transformer (ViT) has prevailed in computer vision tasks due to its strong long-range dependency modelling ability. \textcolor{blue}{However, its large model size and weak l…