2 papers
cs.SD2026
Audio-Zero: Label-Free Self-Evolution for Fine-Grained Audio Reasoning
Siqian Tong, Xuan Li, Chaozhuo Li +5
Large Audio Language models (LALMs) have made rapid progress on acoustic understanding, yet they still struggle with fine-grained audio reasoning (e.g., recognizing event order, re…
cs.SD2026
AuTAgent: A Reinforcement Learning Framework for Tool-Augmented Audio Reasoning
Siqian Tong, Xuan Li, Yiwei Wang +5
Large Audio Language Models (LALMs) excel at perception but struggle with complex reasoning requiring precise acoustic measurements. While external tools can extract fine-grained f…