2 papers
cs.RO2026
NFPO: Stabilized Policy Optimization of Normalizing Flow for Robotic Policy Learning
Diyuan Shi, Yiqi Tang, Zifeng Zhuang +1
Deep Reinforcement Learning (DRL) has experienced significant advancements in recent years and has been widely used in many fields. In DRL-based robotic policy learning, however, c…
cs.LG2024
Data-Incremental Continual Offline Reinforcement Learning
Sibo Gai, Donglin Wang
In this work, we propose a new setting of continual learning: data-incremental continual offline reinforcement learning (DICORL), in which an agent is asked to learn a sequence of…