2 papers
cs.LG2024
Data Poisoning Attacks on Off-Policy Policy Evaluation Methods
Elita Lobo, Harvineet Singh, Marek Petrik +2
Off-policy Evaluation (OPE) methods are a crucial tool for evaluating policies in high-stakes domains such as healthcare, where exploration is often infeasible, unethical, or expen…
cs.LG2020
Soft-Robust Algorithms for Batch Reinforcement Learning
Elita A. Lobo, Mohammad Ghavamzadeh, Marek Petrik
In reinforcement learning, robust policies for high-stakes decision-making problems with limited data are usually computed by optimizing the percentile criterion, which minimizes t…