1 paper
Boyun Zhang, Chao Wang, Kai Wu
In actor-critic reinforcement learning, network architectures are typically manually designed. Automating this design is challenging because each candidate must be trained before e…