1 paper
Zhuyu Teng, Pei Chen, Yichen Cai +5
Despite advances in multimodal AI, current vision-based assistants often remain inefficient in collaborative tasks. We identify two key gulfs: a communication gulf, where users mus…