99 citations · 99 across the 12 of their papers we have counts for
Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
NePPO: Near-Potential Policy Optimization for General-Sum Multi-Agent Reinforcement Learning
Addison Kalanther, Sanika Bharvirkar, Shankar Sastry +1
Multi-agent reinforcement learning (MARL) is increasingly used to design learning-enabled agents that interact in shared environments. However, training MARL algorithms in general-…
cs.LG2017★ 99 cited
Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning
Joshua Achiam, Shankar Sastry
Exploration in complex domains is a key challenge in reinforcement learning, especially for tasks with very sparse rewards. Recent successes in deep reinforcement learning have bee…