1 paper
Huiyin Xue, Nikolaos Aletras
Scaling pre-trained language models has resulted in large performance gains in various natural language processing tasks but comes with a large cost in memory requirements. Inspire…