Showing cs.CVShow all
3 papers · 1 filter
cs.CV2026
Chain of Spatial Thoughts: Modality-Agnostic Spatial Grounding for Vision Language Models
Hunter Schofield, Mohammed Elmahgiubi, Mohammad Mahdavian +4
Spatial understanding is fundamental to embodied intelligence, underpinning applications such as robotic manipulation, embodied navigation, and autonomous driving. Although recent…
cs.CV2025
Box6D : Zero-shot Category-level 6D Pose Estimation of Warehouse Boxes
Yintao Ma, Sajjad Pakdamansavoji, Amir Rasouli +1
Accurate and efficient 6D pose estimation of novel objects under clutter and occlusion is critical for robotic manipulation across warehouse automation, bin picking, logistics, and…
cs.CV2025
WALDO: Where Unseen Model-based 6D Pose Estimation Meets Occlusion
Sajjad Pakdamansavoji, Yintao Ma, Amir Rasouli +1
Accurate 6D object pose estimation is vital for robotics, augmented reality, and scene understanding. For seen objects, high accuracy is often attainable via per-object fine-tuning…