1 paper
Ruitao Feng, Bixi Zhang, Sheng Liang +1
Aligning pretrained audio encoders and Large Language Models (LLMs) offers a promising, parameter-efficient path to building powerful multimodal agents. However, existing methods o…