papers
Publications (15)
cs.CV2023
Text and Click inputs for unambiguous open vocabulary instance segmentation
Nikolai Warner, Meera Hahn, Jonathan Huang +2
cs.AI2025
Proactive Agents for Multi-Turn Text-to-Image Generation Under Uncertainty
Meera Hahn, Wenjun Zeng, Nithish Kannen +4
cs.CV2015
Deep Tracking: Visual Tracking Using Deep Convolutional Networks
Meera Hahn, Si Chen, Afshin Dehghan
cs.CV2018
Learning to Localize and Align Fine-Grained Actions to Sparse Instructions
Meera Hahn, Nataniel Ruiz, Jean-Baptiste Alayrac +2
cs.CV2022
Transformer-based Localization from Embodied Dialog with Large-scale Pre-training
Meera Hahn, James M. Rehg
cs.CV2022
Learning a Visually Grounded Memory Assistant
Meera Hahn, Kevin Carlberg, Ruta Desai +1
cs.CV2023
Photorealistic Video Generation with Diffusion Models
Agrim Gupta, Lijun Yu, Kihyuk Sohn +6
cs.CV2020
Tripping through time: Efficient Localization of Activities in Videos
Meera Hahn, Asim Kadav, James M. Rehg +1
cs.CV2025
MALT Diffusion: Memory-Augmented Latent Transformers for Any-Length Video Generation
Sihyun Yu, Meera Hahn, Dan Kondratyuk +6
cs.CV2021
No RL, No Simulation: Learning to Navigate without Navigating
Meera Hahn, Devendra Chaplot, Shubham Tulsiani +3
cs.CV2021
Where Are You? Localization from Embodied Dialog
Meera Hahn, Jacob Krantz, Dhruv Batra +4
cs.CV2024
Learning Complex Non-Rigid Image Edits from Multimodal Conditioning
Nikolai Warner, Jack Kolb, Meera Hahn +3
cs.CV2024
VideoPoet: A Large Language Model for Zero-Shot Video Generation
Dan Kondratyuk, Lijun Yu, Xiuye Gu +28
cs.CV2019
Action2Vec: A Crossmodal Embedding Approach to Action Learning
Meera Hahn, Andrew Silva, James M. Rehg
cs.CV2023
Which way is `right'?: Uncovering limitations of Vision-and-Language Navigation model
Meera Hahn, Amit Raj, James M. Rehg