1 paper
Sinian Zhang, Kaicheng Zhang, Ziping Xu +4
Offline reinforcement learning for longitudinal studies often faces two linked challenges: rewards may be binary or bounded, and reward observations may be available only for a sub…