1 paper
Yantai Yang, Yuhao Wang, Zichen Wen +5
Vision-Language-Action (VLA) models, particularly diffusion-based architectures, demonstrate transformative potential for embodied intelligence but are severely hampered by high co…