1 paper
Yuhua Jiang, Junjie Lu, Xinyao Qin +4
Vision-language-action (VLA) models inherit rich visual-semantic priors from pre-trained vision-language backbones, but adapting them to robotic control remains challenging. Full f…