3 papers
cs.LG2026
ReversedQ: Opportunities for Faster Q-Learning in Episodic Online Reinforcement Learning
Sofia R. Miskala-Dinc, Aviva Prins
We study model-free Q-learning in finite-horizon episodic Markov Decision Processes (MDPs) with stationary dynamics across episodes. We identify a central issue in nascent model-fr…
cs.LG2025
Efficient Restarts in Non-Stationary Model-Free Reinforcement Learning
Hiroshi Nonaka, Simon Ambrozak, Sofia R. Miskala-Dinc +2
In this work, we propose three efficient restart paradigms for model-free non-stationary reinforcement learning (RL). We identify two core issues with the restart design of Mao et…
cs.LG2025
Comparative Analysis of Multi-Agent Reinforcement Learning Policies for Crop Planning Decision Support
Anubha Mahajan, Shreya Hegde, Ethan Shay +2
In India, the majority of farmers are classified as small or marginal, making their livelihoods particularly vulnerable to economic losses due to market saturation and climate risk…