1 paper
Hrishikesh Viswanath, Juanwu Lu, S. Talha Bukhari +4
Offline goal-conditioned reinforcement learning (GCRL) learns goal-reaching behaviors from static datasets, but accurate value estimation remains challenging under limited state-ac…