1 paper
Heyu Chang, Nianwen Si, Hao Zhang +2
Large audio-language models (LALMs) can hallucinate audio objects, answering "yes" to absent sound events, thus undermining reliability in audio question answering. We propose Toke…