1 paper · 1 filter
Run Luo, Lu Wang, Wanwei He +3
Existing efforts in building Graphical User Interface (GUI) agents largely rely on the training paradigm of supervised fine-tuning on Large Vision-Language Models (LVLMs). However,…