139 citations · 146 across the 11 of their papers we have counts for
1 paper · 1 filter
Yukun Feng, Patrick Xia, Benjamin Van Durme +1
Building pretrained language models is considered expensive and data-intensive, but must we increase dataset size to achieve better performance? We propose an alternative to larger…