1 paper · 1 filter
Yunzhong Xiao, Yangmin Li, Hewei Wang +2
Agents utilizing tools powered by large language models (LLMs) or vision-language models (VLMs) have demonstrated remarkable progress in diverse tasks across text and visual modali…