1 paper
Jingren Liu, Hanzhang Qin, Junyi Liu +2
Offline policy learning aims to use historical data to learn an optimal personalized decision rule. In the standard estimate-then-optimize framework, reweighting-based methods (e.g…