1 paper · 1 filter
Motubrain Team, Chendong Xiang, Fan Bao +17
Vision-Language-Action (VLA) models generalize semantically well but often lack fine-grained modeling of world dynamics. We present Motubrain, a unified World Action Model that joi…