2 papers
cs.LG2025
Trust Region Reward Optimization and Proximal Inverse Reward Optimization Algorithm
Yang Chen, Menglin Zou, Jiaqi Zhang +6
Inverse Reinforcement Learning (IRL) learns a reward function to explain expert demonstrations. Modern IRL methods often use the adversarial (minimax) formulation that alternates b…
cs.LG2025
Meta-Inverse Reinforcement Learning for Mean Field Games via Probabilistic Context Variables
Yang Chen, Xiao Lin, Bo Yan +4
Designing suitable reward functions for numerous interacting intelligent agents is challenging in real-world applications. Inverse reinforcement learning (IRL) in mean field games…