audio token analysis 1decoder readability 1model fine-tuning 1semantic alignment 1temporal audio grounding 1
From the 1 of 3 linked papers with an AI index.
3 papers
cs.SD2026
From Semantics to Readout: Mechanistic Understanding of Audio Tokens after Fine-Tuning for Temporal Audio Grounding
Yujian Ma, Jinqiu Sang, Ruizhe Li +2
The paper studies how fine‑tuning large audio‑language models for temporal audio grounding alters the semantics and decoder accessibility of native audio tokens, finding that fine‑…
eess.AS2026
A Lightweight Fourier-based Network for Binaural Speech Enhancement with Spatial Cue Preservation
Xikun Lu, Yujian Ma, Xianquan Jiang +2
Binaural speech enhancement faces a severe trade-off challenge, where state-of-the-art performance is achieved by computationally intensive architectures, while lightweight solutio…
eess.AS2026
Lightweight Implicit Neural Network for Binaural Audio Synthesis
Xikun Lu, Fang Liu, Weizhi Shi +1
High-fidelity binaural audio synthesis is crucial for immersive listening, but existing methods require extensive computational resources, limiting their edge-device application. T…