2 papers
cs.LG2026
ReversedQ: Opportunities for Faster Q-Learning in Episodic Online Reinforcement Learning
Sofia R. Miskala-Dinc, Aviva Prins
We study model-free Q-learning in finite-horizon episodic Markov Decision Processes (MDPs) with stationary dynamics across episodes. We identify a central issue in nascent model-fr…
cs.LG2025
Efficient Restarts in Non-Stationary Model-Free Reinforcement Learning
Hiroshi Nonaka, Simon Ambrozak, Sofia R. Miskala-Dinc +2
In this work, we propose three efficient restart paradigms for model-free non-stationary reinforcement learning (RL). We identify two core issues with the restart design of Mao et…