3 papers
cs.RO2026
GigaBrain-0.7: Scaling Embodied Foundation Models to Emergent Capabilities with a Three-System Architecture
GigaBrain Team, Angen Ye, Axiang Sun +56
Vision-language-action (VLA) models have become a dominant paradigm for generalist embodied agents, demonstrating strong complex and long-horizon task completion in structured sett…
cs.RO2026
XEWorld: Can Action-Conditioned World Models Generalize to Unseen Robot Embodiments?
Yixiang Chen, Jiabing Yang, Yuan Xu +10
Action-conditioned world models are promising learned simulators for robotic manipulation, yet evaluating them exclusively on training robots fails to reveal whether they capture p…
cs.RO2026
WAM-Nav: Asymmetric Latent World-Action Modeling for Unified Visual Navigation
Ning Yang, Yan Huang, Kaiwen Peng +9
Visual navigation requires generating smooth and collision-free trajectories under complex geometric and physical constraints. Existing reactive policies that directly map observat…