1 paper
Inkyu Sa, Chanoh Park, Hea-Min Lee +2
Vision Language Action (VLA) models unify visual perception, natural-language understanding, and action generation within a single foundation model, allowing a robot to follow inst…