1 paper · 1 filter
Bianca Marin Moreno, Margaux Brégère, Pierre Gaillard +1
Traditional reinforcement learning usually assumes either episodic interactions with resets or continuous operation to minimize average or cumulative loss. While episodic settings…