1 paper · 1 filter
Yilong Wan, Yuqiang Li, Xianyi Wu
We study risk-aware offline policy learning, aiming to learn a decision rule from logged data that is optimal under general risk criteria. This problem is crucial in high-stakes do…