1 paper
Abdul Mohaimen Al Radi, Kunyang Li, Yuzhang Shang +2
Foundation video models produce visually impressive results, but their use in embodied AI remains limited because they are primarily trained on natural language rather than low-lev…