1 paper
Yanqing Liu, Xianhang Li, Letian Zhang +4
This paper provides a simplification on OpenVision's architecture and loss design for enhancing its training efficiency. Following the prior vision-language pretraining works CapPa…