3 papers
cs.LG2022
Offline Policy Comparison with Confidence: Benchmarks and Baselines
Anurag Koul, Mariano Phielipp, Alan Fern
Decision makers often wish to use offline historical data to compare sequential-action policies at various world states. Importantly, computational tools should produce confidence…
cs.LG2020
Dream and Search to Control: Latent Space Planning for Continuous Control
Anurag Koul, Varun V. Kumar, Alan Fern +1
Learning and planning with latent space dynamics has been shown to be useful for sample efficiency in model-based reinforcement learning (MBRL) for discrete and continuous control…
cs.LG2018
Learning Finite State Representations of Recurrent Policy Networks
Anurag Koul, Sam Greydanus, Alan Fern
Recurrent neural networks (RNNs) are an effective representation of control policies for a wide range of reinforcement and imitation learning problems. RNN policies, however, are p…