3 papers
cs.CV2026
SceneTeract: Agentic Functional Affordances and VLM Grounding in 3D Scenes
Léopold Maillard, Francis Engelmann, Tom Durand +5
Embodied AI depends on interactive 3D environments that support meaningful activities for diverse users, yet assessing their functional affordances remains a core challenge. We int…
cs.CV2025
LookOut: Real-World Humanoid Egocentric Navigation
Boxiao Pan, Adam W. Harley, C. Karen Liu +1
The ability to predict collision-free future trajectories from egocentric observations is crucial in applications such as humanoid robotics, VR / AR, and assistive navigation. In t…
cs.CV2025
Animal Pose Labeling Using General-Purpose Point Trackers
Zhuoyang Pan, Boxiao Pan, Guandao Yang +2
Automatically estimating animal poses from videos is important for studying animal behaviors. Existing methods do not perform reliably since they are trained on datasets that are n…