1 paper · 1 filter
Yuchen Jiao, Jiin Woo, Gen Li +2
Average-reward reinforcement learning offers a principled framework for long-term decision-making by maximizing the mean reward per time step. Although Q-learning is a widely used…