1 paper
Songsheng Wang, Rucheng Yu, Zhihang Yuan +4
Vision-Language-Action (VLA) models have made substantial progress by leveraging the robust capabilities of Visual Language Models (VLMs). However, VLMs' significant parameter size…