1 paper
Akshay Mete, Shahid Aamir Sheikh, Tzu-Hsiang Lin +2
Efficient exploration remains a central challenge in reinforcement learning (RL), particularly in sparse-reward environments. We introduce Optimistic World Models (OWMs), a princip…