Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
GraphAllocBench: A Flexible Benchmark for Preference-Conditioned Multi-Objective Policy Learning
Zhiheng Jiang, Yunzhe Wang, Ryan Marr +3
Preference-Conditioned Policy Learning (PCPL) in Multi-Objective Reinforcement Learning (MORL) approximates diverse Pareto-optimal solutions by conditioning a single policy on user…
cs.LG2025
Abstracting Geo-specific Terrains to Scale Up Reinforcement Learning
Volkan Ustun, Soham Hans, Rajay Kumar +1
Multi-agent reinforcement learning (MARL) is increasingly ubiquitous in training dynamic and adaptive synthetic characters for interactive simulations on geo-specific terrains. Fra…