1 paper
Kyunghwan Shim, Jaewoong Yun, Shinkook Choi
Multi-head self-attention (MSA) is a key component of Vision Transformers (ViTs), which have achieved great success in various vision tasks. However, their high computational cost…