1 paper · 1 filter
Kaiwen Cai, Zhekai Duan, Gaowen Liu +2
Recent advancements in Vision-Language (VL) models have sparked interest in their deployment on edge devices, yet challenges in handling diverse visual modalities, manual annotatio…