1 paper
Gnana Praveen Rajasekhar, Jahangir Alam
Conventional audio-visual methods for speaker verification rely on large amounts of labeled data and separate modality-specific architectures, which is computationally expensive, l…