1 paper · 1 filter
Ashish Seth, Mayur Hemani, Chirag Agarwal
Large pre-trained vision-language models (VLMs) reduce the time for developing predictive models for various vision-grounded language downstream tasks by providing rich, adaptable…