Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Towards General Preference Alignment: Diffusion Models at Nash Equilibrium
Jiaming Hu, Jiamu Bai, Haoyu Wang +2
Reinforcement learning from human feedback (RLHF) has been popular for aligning text-to-image (T2I) diffusion models with human preferences. As a mainstream branch of RLHF, Direct…
cs.LG2025
Transfer Learning Under High-Dimensional Network Convolutional Regression Model
Liyuan Wang, Jiachen Chen, Kathryn L. Lunetta +3
Transfer learning enhances model performance by utilizing knowledge from related domains, particularly when labeled data is scarce. While existing research addresses transfer learn…