1 paper
Danielle Rothermel, Margaret Li, Tim Rocktäschel +1
Self-supervised pre-training of large-scale transformer models on text corpora followed by finetuning has achieved state-of-the-art on a number of natural language processing tasks…