2 papers
cs.MA2025
H2-MARL: Multi-Agent Reinforcement Learning for Pareto Optimality in Hospital Capacity Strain and Human Mobility during Epidemic
Xueting Luo, Hao Deng, Jihong Yang +6
The necessity of achieving an effective balance between minimizing the losses associated with restricting human mobility and ensuring hospital capacity has gained significant atten…
cs.LG2025
PVBF: A Framework for Mitigating Parameter Variation Imbalance in Online Continual Learning
Zelin Tao, Hao Deng, Mingqing Liu +2
Online continual learning (OCL), which enables AI systems to adaptively learn from non-stationary data streams, is commonly achieved using experience replay (ER)-based methods that…