1 paper
Yun-Jui Tsai, Wei-Yu Chen, Yan-Ru Ju +2
Reinforcement learning (RL) agents achieve remarkable performance but remain far less learning-efficient than humans. While RL agents require extensive self-play games to extract u…