1 paper · 1 filter
Harry Cheng, Yangyang Guo, Qingpei Guo +4
Multi-modal Large Language Models (MLLMs) have dramatically advanced the research field and delivered powerful vision-language understanding capabilities. However, these models oft…