1 paper · 1 filter
Jiangwei Wang, Shuo Yang, Ziyan An +5
Reward design is a key component of deep reinforcement learning, yet some tasks and designer's objectives may be unnatural to define as a scalar cost function. Among the various te…