2 papers
cs.LG2025
CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation
Zhengzhe Zhang, Wenjia Meng, Haoliang Sun +1
Context-based offline meta-reinforcement learning (OMRL) methods have achieved appealing success by leveraging pre-collected offline datasets to develop task representations that g…
cs.LG2024
Off-OAB: Off-Policy Policy Gradient Method with Optimal Action-Dependent Baseline
Wenjia Meng, Qian Zheng, Long Yang +2
Policy-based methods have achieved remarkable success in solving challenging reinforcement learning problems. Among these methods, off-policy policy gradient methods are particular…