1 citations · 1 across the 1 of their papers we have counts for
3 papers
cs.LG2024
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
Changhong Wang, Xudong Yu, Chenjia Bai +2
In Reinforcement Learning (RL), training a policy from scratch with online experiences can be inefficient because of the difficulties in exploration. Recently, offline RL provides…
cs.LG2024★ 1 cited
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
Xudong Yu, Chenjia Bai, Hongyi Guo +2
Offline Reinforcement Learning (RL) faces distributional shift and unreliable value estimation, especially for out-of-distribution (OOD) actions. To address this, existing uncertai…
cs.LG2024
Regularized Conditional Diffusion Model for Multi-Task Preference Alignment
Xudong Yu, Chenjia Bai, Haoran He +2
Sequential decision-making is desired to align with human intents and exhibit versatility across various tasks. Previous methods formulate it as a conditional generation process, u…