Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Quantile Geometry Regularization for Distributional Reinforcement Learning
Zhaofan Zhang, Minghao Yang, Rufeng Chen +2
Quantile-based distributional reinforcement learning methods learn return distributions through sampled quantile regression, but their bootstrapped target quantiles may induce dist…
cs.LG2024
Tactics2D: A Highly Modular and Extensible Simulator for Driving Decision-making
Yueyuan Li, Songan Zhang, Mingyang Jiang +4
Simulation is a prospective method for generating diverse and realistic traffic scenarios to aid in the development of driving decision-making systems. However, existing simulators…