2 papers
cs.CV2025
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
Mingjie Xu, Jinpeng Chen, Yuzhi Zhao +12
Multimodal large language models (MLLMs) have enabled a wide range of advanced vision-language applications, including fine-grained object recognition and contextual understanding.…
cs.DC2024
Backpropagation-Free Multi-modal On-Device Model Adaptation via Cloud-Device Collaboration
Wei Ji, Li Li, Zheqi Lv +5
In our increasingly interconnected world, where intelligent devices continually amass copious personalized multi-modal data, a pressing need arises to deliver high-quality, persona…