1 paper
Yuezhang Peng, Yuxin Liu, Yao Li +3
Fine-tuning pre-trained speech foundation models for Automatic Speech Recognition (ASR) is prevalent, yet constrained by substantial GPU memory requirements. We introduce ZO-ASR, a…