1 paper · 1 filter
Zhipeng Ye, Jiaqi Huang, Feng Jiang +5
Multimodal Large Language Models (MLLMs) have demonstrated strong capabilities across a wide range of vision language tasks. However, when applied to large scale image classificati…