1 paper
Huozhi Zhou, Jinglin Chen, Lav R. Varshney +1
We consider reinforcement learning (RL) in episodic Markov decision processes (MDPs) with linear function approximation under drifting environment. Specifically, both the reward an…