1 paper
Lorenzo Steccanella, Joshua B. Evans, Ãzgür ÅimÅek +1
This paper presents a state representation framework for Markov decision processes (MDPs) that can be learned solely from state trajectories, requiring neither reward signals nor t…