1 paper · 1 filter
Yang Li, Yuchen Liu, Haoyu Lu +8
Recent progress in Multimodal Large Language Models (MLLMs) has enabled mobile GUI agents capable of visual perception, cross-modal reasoning, and interactive control. However, exi…