1 paper
Xinyu Zhang, Atsushi Konno, Toshihiko Yamasaki +1
Social robot navigation requires a sophisticated integration of scene semantics and human social norms. Scaling up Vision Language Models (VLMs) generally improves reasoning and de…