1 paper
Phanideep Gampa, Sairam Satwik Kondamudi, Lakshmanan Kailasam
We consider the finite horizon continuous reinforcement learning problem. Our contribution is three-fold. First,we give a tractable algorithm based on optimistic value iteration fo…