Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Learning to summarize user information for personalized reinforcement learning from human feedback
Hyunji Nam, Yanming Wan, Mickel Liu +3
As everyday use cases of large language model (LLM) AI assistants have expanded, it is becoming increasingly important to personalize responses to align to different users' prefere…
cs.LG2024
Personalizing Reinforcement Learning from Human Feedback with Variational Preference Learning
Sriyash Poddar, Yanming Wan, Hamish Ivison +2
Reinforcement Learning from Human Feedback (RLHF) is a powerful paradigm for aligning foundation models to human values and preferences. However, current RLHF techniques cannot acc…