3 papers
cs.LG2026
AdamO: A Collapse-Suppressed Optimizer for Offline RL
Nan Qiao, Sheng Yue, Shuning Wang +1
Offline reinforcement learning (RL) can fail spectacularly when bootstrapped temporal-difference (TD) updates amplify their own errors, driving the critic toward extreme and unusab…
cs.LG2025
FOVA: Offline Federated Reinforcement Learning with Mixed-Quality Data
Nan Qiao, Sheng Yue, Ju Ren +1
Offline Federated Reinforcement Learning (FRL), a marriage of federated learning and offline reinforcement learning, has attracted increasing interest recently. Albeit with some ad…
cs.LG2025
AugFL: Augmenting Federated Learning with Pretrained Models
Sheng Yue, Zerui Qin, Yongheng Deng +3
Federated Learning (FL) has garnered widespread interest in recent years. However, owing to strict privacy policies or limited storage capacities of training participants such as I…