1 paper
Yilong Wan, Yuqiang Li, Xianyi Wu
We study risk-aware offline policy learning, aiming to learn a decision rule from logged data that is optimal under general risk criteria. This problem is crucial in high-stakes do…