1 paper
Yuhuan You, Lai Wei, Xihong Wu +1
Large audio-language models have made rapid progress in recognizing what is present in an audio clip, but spatial audio-language understanding still lacks a clear task interface. A…