1 paper
Xinyu Qiao, Yudong Hu, Congying Han +2
Strategy learning in game environments with multi-agent is a challenging problem. Since each agent's reward is determined by the joint strategy, a greedy learning strategy that aim…