1 paper
Jingfeng Shan, Francesco Guidi, Mehrdad Saeidi +8
Autonomous agents operating in uncertain environments must balance fast responses with goal-directed planning. Classical MF RL often converges slowly and may induce unsafe explorat…