1 paper · 1 filter
Meng Ma, Shuyang Li, Naigang Wang +1
Cloud-hosted vision-language models (VLMs) offer greater contextual reasoning capabilities than smaller onboard models, but frequent visual uploads increase communication overhead…