1 paper
Boyang Xu, Qing Zou, Siqin Yang +1
Distributional reinforcement learning (DRL) models the full return distribution, but existing finite-support or quantile-based methods rely on projections, while recent flow-based…