Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
VISA: Value Injection via Shielded Adaptation for Personalized LLM Alignment
Jiawei Chen, Tianzhuo Yang, Guoxi Zhang +3
Aligning Large Language Models (LLMs) with nuanced human values remains a critical challenge, as existing methods like Reinforcement Learning from Human Feedback (RLHF) often handl…
cs.AI2025
Model Evolution Framework with Genetic Algorithm for Multi-Task Reinforcement Learning
Yan Yu, Wengang Zhou, Yaodong Yang +3
Multi-task reinforcement learning employs a single policy to complete various tasks, aiming to develop an agent with generalizability across different scenarios. Given the shared c…