1 paper
Yan Cao, Keting Lu, Xiaoping Chen +1
Reinforcement learning methods have been used to compute dialog policies from language-based interaction experiences. Efficiency is of particular importance in dialog policy learni…