2 papers
cs.LG2025
Diffusion Classifier-Driven Reward for Offline Preference-based Reinforcement Learning
Teng Pang, Bingzheng Wang, Guoqiang Wu +1
Offline preference-based reinforcement learning (PbRL) mitigates the need for reward definition, aligning with human preferences via preference-driven reward feedback without inter…
cs.LG2024
Towards Macro-AUC oriented Imbalanced Multi-Label Continual Learning
Yan Zhang, Guoqiang Wu, Bingzheng Wang +3
In Continual Learning (CL), while existing work primarily focuses on the multi-class classification task, there has been limited research on Multi-Label Learning (MLL). In practice…