1 paper
Seungwhan Moon, Satwik Kottur, Paul A. Crook +9
Next generation virtual assistants are envisioned to handle multimodal inputs (e.g., vision, memories of previous interactions, in addition to the user's utterances), and perform m…