1 paper
Yunxiao Guo, Han Long, Xiaojun Duan +3
As a popular Deep Reinforcement Learning (DRL) algorithm, Proximal Policy Optimization (PPO) has demonstrated remarkable efficacy in numerous complex tasks. According to the penalt…