36 citations · 36 across the 1 of their papers we have counts for
1 paper
Amanpreet Singh, Ronghang Hu, Vedanuj Goswami +4
State-of-the-art vision and vision-and-language models rely on large-scale visio-linguistic pretraining for obtaining good performance on a variety of downstream tasks. Generally,…