1 paper
Mingyang Zhou, Josh Arnold, Zhou Yu
Reinforcement learning (RL) is an effective approach to learn an optimal dialog policy for task-oriented visual dialog systems. A common practice is to apply RL on a neural sequenc…