1 paper · 1 filter
Yuteng Sun, Haoran Wang, Ruofei Bai +4
Large-scale Vision-Language-Action (VLA) models offer semantic generalization but suffer from high inference latency because they adopt a low-frequency batch-and-execute paradigm.…