1 paper
Qingjian Lin, Yuxin Li, Haoyang Zhang +14
Audio-encoder-LLM-decoder architectures have become the dominant paradigm for modern automatic speech recognition (ASR), improving transcription quality through large-scale languag…