1 paper
Reza Zolnouri, Semih Cayci
In this paper, we study how partial observability and inexact latent-state inference affect reward learning from preferences. To that end, we study preference-based reward learning…