1 paper · 1 filter
Rohit Sharma, Shanu Kumar, Avinash Kumar
Pre-trained transformer models such as BERT have shown massive gains across many text classification tasks. However, these models usually need enormous labeled data to achieve impr…