1 paper
Sicen Guo, Tianyou Wen, Chuang-Wei Liu +2
Recent vision foundation models (VFMs), typically based on Vision Transformer (ViT), have significantly advanced numerous computer vision tasks. Despite their success in tasks focu…