1 paper · 1 filter
Aivo Olev, Tanel Alumäe
Large audio language models (LALMs) can answer questions about speech, music, and environmental sounds, yet their internal reasoning is largely opaque and difficult to validate. We…