1 paper
Zaid Pervaiz Bhat, Nimra Nayyar, Arihant Jain +6
As Vision-Language Models (VLMs) advance toward physical deployment, the focus has remained on action-oriented Embodied AI evaluated on subject-centric consumer video. This overloo…