Showing cs.SDShow all
2 papers · 1 filter
cs.SD2026
The Sonar Moment: Benchmarking Audio-Language Models in Audio Geo-Localization
Ruixing Zhang, Zihan Liu, Leilei Sun +2
Geo-localization aims to infer the geographic origin of a given signal. In computer vision, geo-localization has served as a demanding benchmark for compositional reasoning and is…
cs.SD2025
STAR-Bench: Probing Deep Spatio-Temporal Reasoning as Audio 4D Intelligence
Zihan Liu, Zhikang Niu, Qiuyang Xiao +10
Despite rapid progress in Multi-modal Large Language Models and Large Audio-Language Models, existing audio benchmarks largely test semantics that can be recovered from text captio…