1 paper
Sebastian Stapf, Pablo Acuaviva Huertos, Aram Davtyan +1
World models aim to predict plausible futures consistent with past observations, a capability central to planning and decision-making in reinforcement learning. Yet, existing archi…