1 paper
Pablo Ortega-Kral, Eliot Xing, Arthur Bucker +13
Despite recent efforts to collect multi-task, multi-embodiment datasets, to design recipes for training Vision-Language-Action models (VLAs), and to showcase these models on differ…