3 papers
cs.CV2025
Geometry Meets Vision: Revisiting Pretrained Semantics in Distilled Fields
Zhiting Mei, Ola Shorinwa, Anirudha Majumdar
Semantic distillation in radiance fields has spurred significant advances in open-vocabulary robot policies, e.g., in manipulation and navigation, founded on pretrained semantics f…
cs.CV2025
How Confident are Video Models? Empowering Video Models to Express their Uncertainty
Zhiting Mei, Ola Shorinwa, Anirudha Majumdar
Generative video models demonstrate impressive text-to-video capabilities, spurring widespread adoption in many real-world applications. However, like large language models (LLMs),…
cs.RO2025
WoMAP: World Models For Embodied Open-Vocabulary Object Localization
Tenny Yin, Zhiting Mei, Tao Sun +6
Language-instructed active object localization is a critical challenge for robots, requiring efficient exploration of partially observable environments. However, state-of-the-art a…