1 paper
Taichi Kato, Takuya Kiyokawa, Namiko Saito +1
Human-robot collaborative assembly requires robots to interpret ambiguous corrective instructions while producing physically executable motions. Vision-language models (VLMs) provi…