Showing cs.CVShow all
2 papers · 1 filter
cs.CV2024
Efficient Audio-Visual Fusion for Video Classification
Mahrukh Awan, Asmar Nadeem, Armin Mustafa
We present Attend-Fusion, a novel and efficient approach for audio-visual fusion in video classification tasks. Our method addresses the challenge of exploiting both audio and visu…
cs.CV2024
Attend-Fusion: Efficient Audio-Visual Fusion for Video Classification
Mahrukh Awan, Asmar Nadeem, Muhammad Junaid Awan +2
Exploiting both audio and visual modalities for video classification is a challenging task, as the existing methods require large model architectures, leading to high computational…