1 paper
Heinrich Dinkel, Zhiyong Yan, Yongqing Wang +3
Transformers have emerged as a prominent model framework for audio tagging (AT), boasting state-of-the-art (SOTA) performance on the widely-used Audioset dataset. However, their im…