1 paper
Shiang-Feng Tsai, Jin-Cheng Jhang, Yen-Ling Tai +4
Vision-Language-Action (VLA) models leverage large-scale vision-language pretraining for flexible robot manipulation, yet at test time they remain brittle along two axes: spatial g…