18 citations · 27 across the 5 of their papers we have counts for
1 paper · 1 filter
Zheng Li, Zijian Wang, Ming Tan +5
Large-scale pre-trained sequence-to-sequence models like BART and T5 achieve state-of-the-art performance on many generative NLP tasks. However, such models pose a great challenge…