1 paper
Chang-Wei Yueh, Andy Zhao, Ashutosh Nayyar +1
We study Bayesian learning in episodic, finite-horizon zero-sum Markov games with unknown transition and reward models. We investigate a posterior algorithm in which each player ma…