NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (15)

cs.CV2023

Text and Click inputs for unambiguous open vocabulary instance segmentation

Nikolai Warner, Meera Hahn, Jonathan Huang +2

cs.AI2025

Proactive Agents for Multi-Turn Text-to-Image Generation Under Uncertainty

Meera Hahn, Wenjun Zeng, Nithish Kannen +4

cs.CV2015

Deep Tracking: Visual Tracking Using Deep Convolutional Networks

Meera Hahn, Si Chen, Afshin Dehghan

cs.CV2018

Learning to Localize and Align Fine-Grained Actions to Sparse Instructions

Meera Hahn, Nataniel Ruiz, Jean-Baptiste Alayrac +2

cs.CV2022

Transformer-based Localization from Embodied Dialog with Large-scale Pre-training

Meera Hahn, James M. Rehg

cs.CV2022

Learning a Visually Grounded Memory Assistant

Meera Hahn, Kevin Carlberg, Ruta Desai +1

cs.CV2023

Photorealistic Video Generation with Diffusion Models

Agrim Gupta, Lijun Yu, Kihyuk Sohn +6

cs.CV2020

Tripping through time: Efficient Localization of Activities in Videos

Meera Hahn, Asim Kadav, James M. Rehg +1

cs.CV2025

MALT Diffusion: Memory-Augmented Latent Transformers for Any-Length Video Generation

Sihyun Yu, Meera Hahn, Dan Kondratyuk +6

cs.CV2021

No RL, No Simulation: Learning to Navigate without Navigating

Meera Hahn, Devendra Chaplot, Shubham Tulsiani +3

cs.CV2021

Where Are You? Localization from Embodied Dialog

Meera Hahn, Jacob Krantz, Dhruv Batra +4

cs.CV2024

Learning Complex Non-Rigid Image Edits from Multimodal Conditioning

Nikolai Warner, Jack Kolb, Meera Hahn +3

cs.CV2024

VideoPoet: A Large Language Model for Zero-Shot Video Generation

Dan Kondratyuk, Lijun Yu, Xiuye Gu +28

cs.CV2019

Action2Vec: A Crossmodal Embedding Approach to Action Learning

Meera Hahn, Andrew Silva, James M. Rehg

cs.CV2023

Which way is `right'?: Uncovering limitations of Vision-and-Language Navigation model

Meera Hahn, Amit Raj, James M. Rehg