1 paper
Junlin Chen, Ruijie Wang, Jianxin Li
Reinforcement-learning models commonly predict complete future states, observations, or feature occupancies, even though action selection depends only on differences between the co…