1 paper · 1 filter
Xinsong Zhang, Yarong Zeng, Xinting Huang +4
In recent years, the field of vision-language model pre-training has experienced rapid advancements, driven primarily by the continuous enhancement of textual capabilities in large…