1 paper
Natarajan Balaji Shankar, Zilai Wang, Zihan Wang +3
Attention encoder-decoder (AED) Speech Foundation Models achieve strong ASR performance but can generate acoustically unsupported text when inputs contain no speech, weak acoustic…