1 paper
Mingshu Zhao, Yi Luo, Yong Ouyang
Recent advances in vision transformers (ViTs) have demonstrated the advantage of global modeling capabilities, prompting widespread integration of large-kernel convolutions for enl…