Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Data-Augmented Game Starts for Accelerating Self-Play Exploration in Imperfect Information Games
JB Lanier, Nathan Monette, Pierre Baldi +1
Finding approximate equilibria for large-scale imperfect-information competitive games such as StarCraft, Dota, and CounterStrike remains computationally infeasible due to sparse r…
cs.LG2024
Realizable Continuous-Space Shields for Safe Reinforcement Learning
Kyungmin Kim, Davide Corsi, Andoni Rodriguez +5
While Deep Reinforcement Learning (DRL) has achieved remarkable success across various domains, it remains vulnerable to occasional catastrophic failures without additional safegua…