1 paper
Srinivasan Kidambi, Karthik Palaniappan, Pravin Nair
Multi-head self-attention (MHSA) is a key building block in modern vision Transformers, yet its quadratic complexity in the number of tokens remains a major bottleneck for real-tim…