3 papers
cs.CV2026
Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies
Zhixuan Liang, Yizhuo Li, Tianshuo Yang +9
Vision-Language-Action (VLA) models adapt large vision-language backbones to map images and instructions into robot actions. However, prevailing VLAs either generate actions autore…
cs.RO2026
HyperSim: A Holistic Sim-To-Real Framework For Robust Robotic Manipulation
Junyi Dong, Haotian Luo, Ziwei Xu +11
Scaling data volume and diversity is critical for generalizing embodied intelligence. While synthetic data generation offers a scalable alternative to expensive physical data acqui…
cs.RO2025
Research Challenges and Progress in the End-to-End V2X Cooperative Autonomous Driving Competition
Ruiyang Hao, Haibao Yu, Jiaru Zhong +16
With the rapid advancement of autonomous driving technology, vehicle-to-everything (V2X) communication has emerged as a key enabler for extending perception range and enhancing dri…