1 paper
Yexing Du, Kaiyuan Liu, Youcheng Pan +4
Multimodal large language models (MLLMs) have achieved significant success in speech-to-text translation (S2TT). However, when processing multilingual speech inputs, a single speec…