1 paper · 1 filter
Yayun He, Zuheng Kang, Botao Zhao +3
Vision-language models (VLMs) have significantly improved the generalization capabilities of robotic manipulation. However, VLM-based systems often suffer from a lack of robustness…