4 papers
AdamO: A Collapse-Suppressed Optimizer for Offline RL
Nan Qiao, Sheng Yue, Shuning Wang +1
Offline reinforcement learning (RL) can fail spectacularly when bootstrapped temporal-difference (TD) updates amplify their own errors, driving the critic toward extreme and unusab…
Cloud-Edge Collaborative Large Models for Robust Photovoltaic Power Forecasting
Nan Qiao, Shuning Wang, Sijing Duan +5
Photovoltaic (PV) power forecasting in edge-enabled grids requires balancing forecasting accuracy, robustness under weather-driven distribution shifts, and strict latency constrain…
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
Nan Qiao, Sheng Yue
In Internet-of-Things systems, federated learning has advanced online reinforcement learning (RL) by enabling parallel policy training without sharing raw data. However, interactin…
FOVA: Offline Federated Reinforcement Learning with Mixed-Quality Data
Nan Qiao, Sheng Yue, Ju Ren +1
Offline Federated Reinforcement Learning (FRL), a marriage of federated learning and offline reinforcement learning, has attracted increasing interest recently. Albeit with some ad…