1 paper
Rohit Sharma, Shanu Kumar, Avinash Kumar
Pre-trained transformer models such as BERT have shown massive gains across many text classification tasks. However, these models usually need enormous labeled data to achieve impr…