1 paper · 1 filter
Haokun Lin, Haoli Bai, Zhili Liu +5
Vision-language pre-trained models have achieved impressive performance on various downstream tasks. However, their large model sizes hinder their utilization on platforms with lim…