1 paper
Feng Chen, Xianghui Wang, Yuxuan Chen +4
Vision-Language-Action (VLA) models predominantly adopt action chunking, i.e., predicting and committing to a short horizon of consecutive low-level actions in a single forward pas…