1 paper
Weiwei Wang, Yuqiang Li, Xianyi Wu +1
Offline policy evaluation (OPE) is crucial in high-stakes reinforcement learning applications, where new policies must be assessed reliably before deployment. In such settings, poi…