1 paper · 1 filter
Yifan Shen, Jiawen Zhang, Jian Xu +4
While agentic AI and its core multimodal large language models (MLLMs) have demonstrated remarkable promise in language and visual reasoning across domains ranging from daily life…