2 papers
cs.RO2026
GesVLA: Gesture-Aware Vision-Language-Action Model Embedded Representations
Wenxuan Guo, Ziyuan Li, Meng Zhang +7
Vision-Language-Action (VLA) models have shown strong potential for general-purpose robot manipulation by unifying perception and action. However, existing VLA systems primarily re…
cs.CV2026
iGSP:Implicit Gradient Subspace Projection for Efficient Continual Learning of Vision-Language Models
Xuezhi Cui, Dongbo Zhou, Wang Guo +8
Vision-Language Models require efficient adaptation to continually emerging downstream tasks. While Parameter-Efficient Fine-Tuning mitigates catastrophic forgetting, assigning iso…