1 paper
Mohammadreza Tayaranian, Alireza Ghaffari, Marzieh S. Tahaei +3
The large number of parameters of some prominent language models, such as BERT, makes their fine-tuning on downstream tasks computationally intensive and energy hungry. Previously…