1 paper
Qi Lv, Weijie Kong, Hao Li +7
Executing language-conditioned tasks in dynamic visual environments remains a central challenge in embodied AI. Existing Vision-Language-Action (VLA) models predominantly adopt rea…