1 paper
Tim Seyde, Peter Werner, Wilko Schwarting +2
Recent reinforcement learning approaches have shown surprisingly strong capabilities of bang-bang policies for solving continuous control benchmarks. The underlying coarse action s…