1 paper
David Millard, Cecilia Alm, Rashid Ali +2
Federated reinforcement learning typically aggregates value functions or policies by parameter averaging, which emphasizes expected return and can obscure statistical multimodality…