1 paper
Limeng Qiao, Yiyang Gan, Bairui Wang +4
Conventional Vision Transformer simplifies visual modeling by standardizing input resolutions, often disregarding the variability of natural visual data and compromising spatial-co…