1 paper · 1 filter
Leon Halgryn, Sophie Langer, Janusz M. Meylahn +1
Finite-sample analyses of deep Q-learning typically treat replayed data as independent, even though it is sampled from temporally dependent state-action trajectories. We study the…