1 paper
Huang Huang, Fangchen Liu, Letian Fu +5
Vision-Language-Action (VLA) models aim to predict robotic actions based on visual observations and language instructions. Existing approaches require fine-tuning pre-trained visio…