4 citations · 7 across the 4 of their papers we have counts for
1 paper · 1 filter
Andreas Rücklé, Gregor Geigle, Max Glockner +4
Massively pre-trained transformer models are computationally expensive to fine-tune, slow for inference, and have large storage requirements. Recent approaches tackle these shortco…