1 paper · 1 filter
Sunghwan Han, Youngtae Han, Youngmin Yi
Vision-Language-Action (VLA) models, built upon Vision-Language Models (VLMs), have significantly enhanced robotic capabilities by leveraging internet-scale knowledge and multimoda…