2 papers
cs.MA2025
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
Cuiling Wu, Yaozhong Gan, Junliang Xing +1
We propose Multi Agent Reflective Policy Optimization (MARPO) to alleviate the issue of sample inefficiency in multi agent reinforcement learning. MARPO consists of two key compone…
cs.RO2025
Integrating Offline Pre-Training with Online Fine-Tuning: A Reinforcement Learning Approach for Robot Social Navigation
Run Su, Hao Fu, Shuai Zhou +1
Offline reinforcement learning (RL) has emerged as a promising framework for addressing robot social navigation challenges. However, inherent uncertainties in pedestrian behavior a…