1 paper
Yunbei Zhang, Akshay Mehra, Jihun Hamm
Vision Transformers (ViTs) have demonstrated remarkable capabilities in learning representations, but their performance is compromised when applied to unseen domains. Previous meth…